Распознавание кодов маркировки с фото и PDF
Читает коды с фотографий, сканов и PDF-файлов эмиссии — сразу пачкой, а не по одному. Разделители групп сохраняются: именно они теряются, когда код переносят с телефона через мессенджер. Файлы не загружаются на сервер — распознавание идёт в браузере.
Сканер в браузере: наведите камеру на код — он попадёт в общий список, откуда всю пачку можно выгрузить одним файлом. На телефоне удобнее, чем пересылать коды по одному через мессенджер.
- Снимок или страница PDF разбирается прямо в браузере — файл никуда не отправляется.
- На изображении ищутся все коды сразу: если в кадр попала пачка этикеток, возьмутся все, а не первый попавшийся.
- Из PDF эмиссии картинки достаются напрямую, без прорисовки страниц — поэтому файл на сотни кодов разбирается за секунду.
- Прочитанный код проверяется по справочнику структур «Честного знака». Если разделителей в коде не было, они расставляются по структуре.
- Разделители групп сохраняются как есть — ради этого инструмент и нужен: при переносе кода через мессенджер или текстовое поле они пропадают.
- Повторы в список не попадают: код, который держали в кадре несколько секунд, добавится один раз.
- Код должен занимать заметную часть кадра. Мелкий код на общем плане не прочитается — как и сильно смазанный.
- Товарную группу по коду определить нельзя: одну структуру используют десятки групп.
- Если разделители нужно поправить руками — инструмент восстановления разделителей покажет ленту символов и варианты расстановки.
Поиск по документации маркировки
Вопрос обычной фразой — «что означает эта ошибка», «какая структура кода у молочной продукции» — и ответ по смыслу с цитатами на источник. База собрана из документации «Честного знака» и материалов этого раздела.
Спросить документациюПочему при съёмке разделители не теряются
Разделители групп закодированы в самом символе DataMatrix — это часть данных, а не оформление. Декодер отдаёт их вместе с остальными символами, поэтому код, прочитанный с этикетки, приходит целым. GS теряется не при чтении кода, а при переносе: когда строку пересылают в мессенджере, вставляют в Excel или через буфер обмена. Если код напечатан вообще без разделителей, инструмент расставит их по структуре — но только когда все подходящие шаблоны дают одну раскладку. Иначе это было бы гаданием, и тогда расстановку лучше сделать в соседнем инструменте, где шаблон выбирается вручную.
Что читается, а что нет
- Фотография этикетки — да, в том числе с наклоном и лёгким расфокусом.
- Несколько кодов на одном снимке — да, ищутся все сразу: типичный сценарий — сфотографировать лист этикеток целиком.
- PDF эмиссии — да. Файл разбирается напрямую, картинки распаковываются без растеризации страниц: четыре сотни кодов читаются примерно за треть секунды.
- PDF, где код нарисован векторно — нет. В таком файле нет картинки, которую можно прочитать; понадобится печать в изображение.
- Сильный расфокус или мелкая печать — нет. Нужно около трёх пикселей на модуль кода; размытие радиусом больше трети модуля код убивает.
- Живая камера — да, кадр берётся несколько раз в секунду, повторы отсекаются автоматически.
Частые вопросы
Куда загружаются мои фотографии и PDF?
Никуда. Распознавание целиком идёт в браузере: файл не покидает ваш компьютер, на сервер поднимаются только распознанные строки кодов. Это не только про приватность — один кадр с телефона разворачивается в десятки мегабайт, и обрабатывать их на сервере было бы и дороже, и медленнее. Из поднятых строк для статистики раздела сохраняется только код товара (GTIN) — тот, что одинаков для всей партии; серийные номера не сохраняются.
Почему код с фотографии не читается?
Чаще всего не хватает разрешения или резкости: нужно примерно три пикселя на один модуль кода. Снимайте ближе, без зума, при ровном освещении и без бликов на плёнке. Сильно размытый или частично закрытый код не прочитает ни один декодер.
Сохраняются ли разделители групп при распознавании?
Да. Разделители — часть данных, закодированных в символе DataMatrix, и декодер отдаёт их как есть. Именно поэтому код, прочитанный с этикетки, обычно целый, а тот же код после пересылки текстом — уже нет.
Можно ли читать коды из PDF эмиссии?
Да, и это самый быстрый путь: в таких файлах каждая страница — готовая картинка, она распаковывается напрямую. PDF, где код нарисован векторными элементами, этим способом не берётся.
Сколько кодов можно распознать за раз?
Ограничение — размер файла (до 64 МБ) и терпение вкладки. Реальные файлы эмиссии на 400 кодов разбираются за доли секунды; коллаж из десятков снимков тоже читается, но медленнее.
Инструменты сделал Sensei — сервис ответов по базе знаний
Sensei отвечает на вопросы команды словами вашей же документации: подключаете wiki, регламенты, таблицы и историю обращений — сотрудник спрашивает обычной фразой и получает ответ с цитатами, по которым видно, откуда он взят.
Демо открыто без регистрации. Для своей базы знаний есть бесплатный тариф.