Счета и чеки

OCR счетов и чеков, который заканчивается записью, а не грудой текста.

Входящий документ должен превращаться в поля, которые можно провести в учёте. Всё, что между сканом и записью, — это работа, которую кто-то должен делать.

Что получается на выходе

Не сплошной текст документа, а поля: поставщик, номер и дата, позиции, налог, итог. Форму ответа задаёте вы — под ту систему, куда эти данные должны попасть.

Реквизиты

Поставщик, номер, дата, сумма к оплате. То, по чему документ находят в учёте.

  • Выход
  • Поля, а не текст

Позиции

Строки таблицы с описанием, количеством и суммой по каждой строке.

  • Форма
  • Список записей

Налог и итог

Разбивка по ставкам и итоговая сумма — в том виде, в каком их ждёт ваша система.

  • Разбивка
  • По вашей схеме

Почему обычный конвейер состоит из трёх частей

Обычно так: сканирование → отдельный сервис распознавания → модель, которая разбирает полученный текст. Три звена, два стыка. Каждый стык — это место, где теряется структура: распознаватель отдаёт ровный текст и по дороге теряет, что было в какой колонке.

Здесь звено одно. Flash принимает изображение или PDF напрямую и видит и текст, и вёрстку одновременно. Поэтому таблица остаётся таблицей, а не превращается в строку чисел без подписей.

Где объём

  • Входящие счета от поставщиков: поток ровный, документы однотипные
  • Авансовые отчёты и чеки сотрудников: фотографии с телефона, разное качество
  • Перенос архива: старые документы, которые нужно разобрать один раз
  • Документы на нескольких языках в одном потоке

Что это значит для команды

Люди перестают быть прослойкой между сканом и учётной системой. Их работа смещается туда, где действительно нужен человек: разобрать спорный документ, проверить нестандартный случай, договориться с поставщиком.

Важно сказать прямо: модель не заменяет контроль. Если ваш процесс требует, чтобы результат проверил человек, — это остаётся вашим процессом, и мы это только поддерживаем, а не отменяем.

Частые вопросы

Нужно ли что-то делать с качеством сканов?

Нет. Изображение уходит в модель как есть. Наклон, блики и плохое освещение — обычные условия, а не повод для отдельной подготовки файлов.

Можно ли получить ответ сразу в нужной схеме?

Да. Схему задаёте вы, и ответ приходит в ней. Это убирает шаг, на котором разобранный текст потом раскладывают по полям кодом.

Что с документами на нескольких языках?

Один поток может содержать документы на разных языках. Модель читает их в одном вызове, отдельный маршрут под каждый язык не нужен.

Кто отвечает за ошибки в разборе?

Ответственность за результат в вашем учёте остаётся на вашей стороне — как и с любым другим поставщиком. Мы отвечаем за доступ к модели и за условия, зафиксированные в договоре.

РАЗБОР СЧЁТОВ

Схема процесса: три этапа, соединённые стрелками; средний этап выделен.

Вход

Скан или фото счёта

PDF · JPEG · PNG

DeepSeek V4.1 Flash

Выход

Поставщик, позиции, итог

одной записью

  • Сканы и фотографии читаются напрямую
  • Весь документ уходит в одном вызове
  • Отдельный сервис распознавания не нужен
От скана до готовой записи — один шаг, а не три.Схема профиля нагрузки. Не скриншот.

Расскажите, какой объём и что используете сейчас.

Обычно ответим в течение одного рабочего дня: условия и персональный менеджер.