La factura crece con la carga
Leer facturas, extraer campos, clasificar, resumir — mucho volumen y poco razonamiento. Justo ahí la gama del modelo deja de importar y solo importa el precio.
Cambie una línea — la base_url — y mueva las mismas cargas de trabajo a
DeepSeek V4.1 Flash. Nosotros ponemos el contrato, la factura y una persona de contacto.
El ahorro se queda en su cuenta.
from openai import OpenAI client = OpenAI(- base_url="https://api.deepseek.com/v1",- api_key=os.environ["DEEPSEEK_API_KEY"],+ base_url="https://api.workhorseapi.com/v1",+ api_key=os.environ["WORKHORSE_API_KEY"],) # todo lo demás sigue igual
Pensado para equipos que mueven lectura de facturas, extracción de documentos y clasificación a gran escala.
Casi siempre empieza igual: alguien toma el modelo más potente que encuentra, lo pone en producción y funciona. Dos años después la carga es diez veces mayor — y nadie ha vuelto a preguntar si de verdad sigue haciendo falta el modelo más potente.
Leer facturas, extraer campos, clasificar, resumir — mucho volumen y poco razonamiento. Justo ahí la gama del modelo deja de importar y solo importa el precio.
Las API de autoservicio están pensadas para particulares: nadie al teléfono, un contrato estándar que no se puede tocar, saldo en vez de pedido, y un alta que rechaza los dominios corporativos.
Desarrollo tiene su hoja de ruta. Rehacer una tubería en producción para ahorrar dinero no es prioridad de nadie — hasta que alguien pregunta por qué la partida de IA se ha duplicado.
Todo lo de aquí sale de la ficha publicada del modelo — sin desfiles de benchmarks ni cifras inventadas.
Cabe un contrato entero, un expediente de siniestro completo o un PDF de varios cientos de páginas — sin montar antes una tubería de troceado.
1.000.000 tokensExtracción estructurada a lo grande: matrices JSON largas, documentos reescritos por completo, clasificación masiva en una sola respuesta.
384.000 tokensRecibos, escaneos, capturas y material de vídeo entran tal cual — sin una pila de OCR aparte que mantener y pagar por otro lado.
Entrada de visiónLos lotes, los reprocesos nocturnos y las pasadas periódicas se van a las horas valle y cuestan la mitad. Precios publicados, no una promoción.
50 % en horas valleENTRADA ESCANEADA
lectura nativa
Maqueta de ejemplo. Sin datos reales de factura.
SALIDA ESTRUCTURADA
imagen dentro, campos fuera
{
"vendor": "…",
"invoice_number": "…",
"issue_date": "…",
"line_items": [
{ "description": "…", "qty": … },
{ … }
],
"tax": …,
"total": …
}
Se muestran los nombres de campo; los valores se omiten.
Sin proyecto de migración. Sin odisea de compras. Sin tocar su aplicación más allá del endpoint.
Mándenos su consumo mensual de tokens y qué está usando hoy. Si no podemos quedar por debajo de su coste actual, se lo decimos.
Una persona de contacto fija, un contrato que su departamento legal puede negociar y una factura en condiciones para su contabilidad.
Apunten su cliente compatible con OpenAI actual a nuestro endpoint. Dejen su proveedor de hoy configurado como respaldo.
NOSOTROS LO HACEMOSUSTED LO HACE
1
Cuéntenos su volumen
Consumo de tokens al mes y qué usa hoy. Si no podemos quedar por debajo de su coste actual, se lo decimos.
2
Calculamos y firmamos
Una persona de contacto fija, un acuerdo negociable, una factura.
- base_url="…"
+ base_url="…"
# nada más cambia3
Usted cambia una línea
Apunten su cliente actual a nuestro endpoint. Dejen preparada una vía de vuelta.
base_url.Esquema de la secuencia de alta. No es una captura de pantalla.Cada una de estas cargas tiene su propia página con el planteamiento completo: la forma de la carga, la llamada a la API y lo que cuesta frente a lo que usted paga hoy.
Líneas, impuestos, totales y datos del proveedor a partir de facturas recibidas — incluidas las escaneadas y las fotografiadas.
Ir a Lectura de facturasContratos, expedientes y formularios se convierten en registros estructurados — los documentos largos entran de una pieza, sin tubería de troceado.
Ir a Extracción de documentosOrdenar tickets, correos y documentos entrantes hacia la cola correcta — mucho volumen, y el listón de precisión cae de lleno en el terreno Flash.
Ir a ClasificaciónLos recibos fotografiados y los escaneos malos los lee el modelo directamente — sin un servicio de OCR aparte que mantener al lado.
Ir a Leer recibosAutocompletado, revisión y generación de pruebas dentro de sus propias herramientas — es un endpoint, así que encaja en lo que su equipo ya usa.
Ir a Asistencia de códigoConjuntos generados a partir de sus propios ejemplos y reglas — no inventados desde un prompt suelto, y validados contra su esquema.
Ir a Datos sintéticosEstas son las seis cargas que más vemos. Si la suya no está aquí, descríbala en el formulario de abajo — o lea cómo salimos frente a contratar directamente con DeepSeek.
Quien lo quiere y quien puede pararlo casi nunca son la misma persona. Esto es lo que escucha cada una de ellas.
“¿Se pueden adaptar las condiciones?”
No estamos atados a una única condición estándar. Firmamos un acuerdo de tratamiento de datos y trabajamos las preguntas de su departamento legal antes de que se comprometa.
“¿Cómo se contabiliza esto?”
Transferencia bancaria. Una factura mensual con el detalle que necesita su contabilidad. Para cuentas consolidadas se pueden acordar plazos de pago.
“¿Y si no sale bien?”
Somos un segundo canal, no un reemplazo. Deje su configuración actual donde está y envíenos una parte del tráfico. Volver atrás es igual de fácil que entrar.
CAMBIA UNA LÍNEA
Su aplicación
El SDK de OpenAI que ya tiene en producción.
api.workhorseapi.com
La misma forma de petición. El mismo streaming.
ENDPOINT DE WORKHORSE
DeepSeek V4.1 Flash
1 M de contexto · 384K de salida
la respuesta vuelve por el mismo camino
QUÉ GESTIONAMOS ALREDEDOR
Ese es el punto de partida de cualquier presupuesto. Dónde cae su cifra concreta depende del volumen, de la tasa de acierto de caché y de la parte que pueda irse a horas valle — cuéntenos eso y se la mandamos.
Díganos su volumen mensual de tokens y qué está usando hoy. Le respondemos con una tarifa y una comparación directa con su factura actual.
Solicitar presupuestoNo. Somos un proveedor independiente — no estamos vinculados a DeepSeek ni contamos con su recomendación. Revendemos acceso a DeepSeek V4.1 Flash y asumimos la parte administrativa alrededor: contrato, facturación, gestión y una persona de contacto fija.
Si le basta con autoservicio, contratar directamente es una opción perfectamente razonable.
Por transferencia bancaria contra factura mensual. En este sitio no hay ningún proceso de pago — aquí no aceptamos tarjetas. El precio se acuerda con su persona de contacto y se confirma en el contrato.
Sí, ambos. Las condiciones del contrato son negociables y podemos firmar un acuerdo de tratamiento de datos. Esa es la diferencia práctica principal frente a una API de autoservicio, cuya condición estándar normalmente no se puede modificar.
Normalmente el mismo día. La API es compatible con OpenAI, así que en la mayoría de bases de código es un cambio de base_url y de clave de API — nada más. Acompañamos a sus desarrolladores en el proceso.
Tratamos los datos de las peticiones para atender sus solicitudes y no los vendemos. El cuadro completo está en nuestra política de privacidad y en el acuerdo de tratamiento de datos. Díganos si tiene requisitos sobre dónde se alojan — le confirmamos por adelantado qué podemos cubrir.
Las llamadas en horas valle se facturan a la mitad. Eso encaja con cargas por lotes — reprocesos nocturnos, reejecuciones masivas, extracciones periódicas — donde un retraso de unas horas no cuesta nada.
OpenRouter enruta hacia una gama de modelos muy amplia. Nosotros hacemos una cosa: DeepSeek V4.1 Flash, lo más barato posible y con un circuito comercial ordenado. Si necesita una docena de familias de modelos tras una sola clave, ellos son la mejor opción. Si el trabajo lo hace DeepSeek, por aquí suele salir más barato.
Tiene una persona de contacto fija — una persona, no una cola de tickets. Deje su proveedor actual configurado como respaldo, para que un mal día no se convierta en una interrupción del servicio.
Es un modelo de gama Flash, no un modelo tope de razonamiento. El razonamiento complejo en varios pasos y las matemáticas duras están mejor en un modelo más grande. Tampoco acepta entrada de audio. Si su carga necesita algo de eso, se lo decimos en lugar de venderle algo que no encaja.
Sí — el modelo lleva bien cargas multilingües, incluida la traducción y la extracción de documentos en otros idiomas. Díganos qué idiomas le importan y se lo confirmamos por adelantado.
Sí. Los endpoints siguen el esquema de chat completions de OpenAI, así que los SDK oficiales de openai — y todo lo que se apoya en ellos — funcionan sin cambios. Para la mayoría de los equipos, todo el cambio consiste en la base_url más la clave de API.
V4.1 Flash admite una ventana de contexto de 1 M de tokens y devuelve hasta 384K tokens. Eso cubre documentos largos, pedidos de varios archivos y lotes grandes de extracción sin trocear todo a mano.
La concurrencia en Flash llega hasta 2.500. Los límites de su cuenta los fijamos durante el alta, a partir del volumen que nos indique — dénos su concurrencia punta y le confirmamos por escrito a qué nos comprometemos.
Sí, y en los lotes es donde la factura se pone interesante. Combinado con las horas valle, la tarifa por token queda a la mitad de la punta. Encaja con reprocesos nocturnos y reejecuciones periódicas, donde un retraso de unas horas no cuesta nada.
Los tokens de entrada en caché se facturan a una tarifa bastante más baja que los frescos. Si en cada llamada manda el mismo bloque inicial grande — un esquema, un bloque largo de instrucciones, un conjunto fijo de ejemplos —, el caché suele ser la mayor palanca de la factura. Revisamos la estructura de sus prompts con usted.
Es justo para lo que lo usa la mayoría de nuestros clientes. Flash acepta entrada de imagen directamente, así que los escaneos de facturas, recibos y formularios entran tal cual — sin un paso de OCR aparte delante. La entrada de vídeo también funciona.
Las dos cosas, sí. Podemos firmar un acuerdo de tratamiento de datos, y el contrato marco es negociable. Una API de autoservicio normalmente no puede modificar sus condiciones estándar — y ahí es donde suele terminar la revisión legal.
Escribimos compromisos de tiempo de respuesta y disponibilidad en el contrato, y le decimos con claridad antes de firmar qué podemos comprometer y qué no. No publicamos un porcentaje de disponibilidad genérico que después tuviéramos que defender.
Tiene una persona de contacto fija y una factura mensual desglosada. Díganos qué necesita ver su contabilidad en ella y ajustamos el desglose a eso.
Verificamos empresas y usuarios finales antes del alta frente a la normativa vigente de control de exportaciones y sanciones. Díganos dónde están su sociedad y sus usuarios y se lo confirmamos antes de que se comprometa.
Nada se lo impide. Su integración es una base_url y una clave — el mismo código funciona contra cualquier endpoint compatible con OpenAI. No hay un SDK propio que haya que desmontar.
Cuéntenos su volumen mensual y qué está usando hoy, con el formulario de abajo. Solemos responder en un día hábil con un precio y una persona de contacto fija.
Cada solicitud la lee una persona. Respondemos normalmente dentro de un día hábil — con un precio y una comparación con su factura actual.