Leia documentos com uma chamada.
Se o seu time já integra APIs, esta é mais uma: envie uma imagem ou um PDF, receba texto e campos estruturados.
O que você recebe de volta
O texto completo da página, mais os campos que você pediu no prompt. O formato é o mesmo de qualquer outra chamada ao modelo: você descreve a estrutura que quer e o modelo a devolve.
A confiança por campo é o que torna o resultado usável em produção. Sem ela, o seu sistema precisa confiar em tudo ou revisar tudo. Com ela, dá para mandar para revisão só os campos que saem duvidosos.
O que você não precisa mais construir
- A etapa de OCR anterior, que convertia imagem em texto
- A heurística para reconstruir tabelas a partir de texto puro
- O detector de idioma quando o documento mistura dois
- A divisão de PDFs longos em páginas separadas
Quando NÃO usar isto
| Situação | Melhor outra coisa |
|---|---|
| Documentos impressos limpos, em um só idioma, sempre iguais | Um OCR tradicional sai mais barato por página |
| Você precisa de resposta em menos de 200 ms | Um modelo pequeno local pode ser mais rápido |
| Centenas de milhões de páginas por mês | Vale conversar antes: o custo por página manda |
Para testar
Não existe ambiente de teste aberto ao público. Se você quer avaliar com os seus próprios documentos, diga-nos quantos e de que tipo: montamos um teste delimitado antes de você assinar qualquer coisa.
API OCR
Entrada
Dados de imagem através da API
PNG · JPEG · páginas PDF
DeepSeek V4.1 Flash
Saída
JSON de volta conforme o seu esquema
o mesmo cliente que você já usa
- Entrada de imagem nativa, sem etapa de OCR
- Formato de requisição compatível com a OpenAI
- Saída estruturada conforme a sua especificação
Conte-nos o que você usa hoje.
Envie-nos seu volume mensal e seu provedor atual. Respondemos normalmente dentro de um dia útil — com um preço e um contato fixo.