Lea documentos con una llamada.
Si su equipo ya integra APIs, esto es una más: manda una imagen o un PDF, recibe texto y campos estructurados.
Qué recibe de vuelta
Texto completo de la página, más los campos que le haya pedido en el prompt. El formato es el mismo que el de cualquier otra llamada al modelo: usted describe la estructura que quiere y el modelo la devuelve.
La confianza por campo es lo que hace usable el resultado en producción. Sin ella, su sistema tiene que fiarse de todo o revisar todo. Con ella, puede mandar a revisión solo los campos que salen dudosos.
Lo que ya no tiene que construir
- El paso previo de OCR que convertía imagen en texto
- La heurística para reconstruir tablas a partir de texto plano
- El detector de idioma cuando el documento mezcla dos
- El troceado de PDF largos en páginas sueltas
Cuándo NO usar esto
| Situación | Mejor otra cosa |
|---|---|
| Documentos impresos limpios, en un solo idioma, siempre iguales | Un OCR clásico sale más barato por página |
| Necesita respuesta en menos de 200 ms | Un modelo pequeño local puede ser más rápido |
| Cientos de millones de páginas al mes | Conviene hablarlo antes: el coste por página manda |
Para probarlo
No hay entorno de pruebas abierto al público. Si quiere evaluarlo con sus propios documentos, díganos cuántos y de qué tipo: montamos una prueba acotada antes de que firme nada.
API DE OCR
Entrada
Datos de imagen a través de la API
PNG · JPEG · páginas PDF
DeepSeek V4.1 Flash
Salida
JSON de vuelta según su esquema
el mismo cliente que ya usa
- Entrada de imagen nativa, sin paso de OCR
- Forma de petición compatible con OpenAI
- Salida estructurada según su especificación
Cuéntenos qué usa hoy.
Envíenos su volumen mensual y su proveedor actual. Respondemos normalmente en un día hábil — con un precio y una persona de contacto fija.