Меньше компонентов
Отдельный сервис распознавания становится не нужен. Меньше кода, меньше точек отказа, меньше счетов к оплате.
Flash принимает изображения и видео напрямую. Это убирает из вашего конвейера целый компонент — вместе с его счётом, его очередью и его ошибками распознавания.
Обычный конвейер выглядит так: файл → отдельный сервис распознавания → текст → модель. Каждый стык — это место, где что-то ломается: распознавание ошибается на таблицах, теряет структуру, не понимает рукописные пометки, и всё это приходится чинить отдельно.
Здесь изображение уходит в модель как есть. Модель видит и текст, и вёрстку, и то, что рядом с текстом: печать, подчёркивания, пометки на полях. Задача формулируется словами, а не набором правил для распознавателя.
Отдельный сервис распознавания становится не нужен. Меньше кода, меньше точек отказа, меньше счетов к оплате.
Можно попросить сразу нужную форму ответа: поля, суммы, даты, позиции таблицы — а не сырой текст, который потом надо разбирать.
Flash принимает и видео. Это пригодится там, где раньше приходилось выдёргивать кадры и обрабатывать их по отдельности.
Модель не заменяет юридическую экспертизу и не гарантирует безошибочное распознавание. На плохих сканах ошибки будут — как и у любого распознавателя. Разница в том, что здесь вы можете описать задачу и попросить модель отметить сомнительные места, вместо того чтобы разбираться с необработанными символами.
Если ваш процесс требует, чтобы результат был выверен человеком, это остаётся вашей ответственностью. Мы со своей стороны даём доступ к модели, а не гарантию безошибочности.
СКАН НА ВХОДЕ
читает напрямую
Пример макета. Реальных данных счёта нет.
СТРУКТУРА НА ВЫХОДЕ
поля из изображения
{
"vendor": "…",
"invoice_number": "…",
"issue_date": "…",
"line_items": [
{ "description": "…", "qty": … },
{ … }
],
"tax": …,
"total": …
}
Показаны имена полей, значения — нет.
Обычно ответим в течение одного рабочего дня: условия и персональный менеджер.