API OCR de pasaportes y documentos de identidad – una llamada HTTP, 1¢ por documento
doc.cheap es una API OCR de pasaportes y documentos de identidad que convierte la foto de un documento de viaje en JSON estructurado con una sola solicitud HTTP. Envías una imagen y recibes la zona de lectura mecánica (MRZ) analizada, los dígitos de control de ICAO 9303 verificados y los campos de la zona de inspección visual extraídos, en la misma respuesta, sin cola que consultar ni SDK que instalar. Tu primera llamada correcta tarda menos de 60 segundos y no requiere registro: el ejemplo de abajo ya lleva una clave pública de sandbox. Cada documento reconocido cuesta 1¢, el mismo precio desde tu primer documento hasta el diezmillonésimo, y un escaneo que no encuentra nada no cuesta nada.
- ✓ Una sola llamada síncrona
- ✓ Primera llamada en 60 segundos
- ✓ Sin registro para empezar
- ✓ JSON plano, sin nada que parsear
Una animación decorativa: la Tierra, con los continentes dibujados con los caracteres de una zona de lectura mecánica, gira y luego se despliega en un mapa plano. Debajo se escribe la zona de lectura mecánica del pasaporte de muestra que se usa en todo este sitio.
Pruébalo ahora – sin cuenta, sin tarjeta, sin periodo de prueba
Sube la imagen de un documento y verás en pantalla los campos reconocidos. La demo procesa tu propia imagen con la clave pública del sandbox – un reconocimiento real, gratis y sin cuenta – y la solicitud de al lado es exactamente la misma, lista para pegar en una terminal. Cuando lo quieras en tu propio código, la guía del primer reconocimiento (en inglés) te lleva desde aquí.
Pruébalo ahora – sin cuenta
Suelta la imagen de un pasaporte o documento de identidad y el reconocimiento empieza al instante. Se redimensiona en tu navegador y se envía al sandbox público; la imagen nunca se guarda.
La misma llamada, en tu terminal
curl -X POST https://api.doc.cheap/v1/scans \
-H "Authorization: Bearer sk_sandbox_public" \
-H "Content-Type: application/json" \
-d "{\"image\": \"$(base64 < document.jpg | tr -d '\n')\"}" El resultado del reconocimiento aparece abajo en cuanto eliges una imagen: cada campo, en cada idioma en que se leyó, con la zona de lectura mecánica comprobada dígito a dígito.
Qué recibes: cada campo, con comprobación cruzada
Una sola respuesta contiene toda la lectura. La zona de lectura mecánica se comprueba dígito a dígito según ICAO 9303 y vuelve como un único veredicto, junto con las líneas de las que se leyó; cada campo impreso en la página vuelve con un nombre estable, una vez por cada idioma en que se leyó. Cada campo indica su propia confianza. Reconocer un pasaporte recorre la llamada completa, y el explorador de campos enumera cada clave con su tipo.
meta
Qué es este escaneo y cómo fue: su id, su estado, si consumió un crédito y en qué se fue el tiempo.
schema_version · id · status · billed · confidence · timing · created_at · reference
document
Qué tipo de documento se reconoció, qué Estado lo emitió, su número y sus fechas, y si ha caducado. Null cuando no se reconoció nada.
kind · country · country_name · issuing_state · type_name · type_confidence · number · series · issue_date · expiry_date · is_expired · days_remaining
holder
La persona a la que identifica el documento. Null cuando no se reconoció nada.
given_names · surname · full_name · birth_date · sex · nationality
fields[]
Cada campo leído en la página impresa, con un nombre estable. Una entrada por lectura, cada una con su idioma y su nivel de confianza.
id · name · label · category · value · language · confidence
mrz
La zona de lectura mecánica: un veredicto sobre si es correcta, el motivo cuando no lo es y las líneas tal como se leyeron.
status · reason · lines · text
images
Recortes de la imagen que enviaste, cada uno como data URL.
document_crop · rear · main_photo · signature · watermark_face · barcode · chip
quality
Si la imagen que enviaste era lo bastante buena para reconocerla.
overall
authenticity
Verificación de autenticidad. No se ejecuta en la llamada de solo reconocimiento, que la indica como no comprobada.
overall · checks
Una zona de muestra, y lo que hace el analizador con ella
Titular inventado, números inventados, dígitos de control calculados a partir de ellos. Pégala en el analizador de MRZ para ver cada dígito recalculado en tu propio navegador, o lee en qué se diferencian TD1, TD2 y TD3.
P<GRCPARADEIGMA<<ELENI<SOFIA<<<<<<<<<<<<<<<<
AM73045184GRC9403084F3203101PN48291630<<<<72Precios: 1¢ por documento – y solo cuando funciona
1¢ por documento
El mismo precio para todos y a cualquier volumen: el primer documento y el diezmillonésimo cuestan lo mismo.
Solo pagas los documentos que realmente reconocemos.
Foto borrosa, ningún documento en el encuadre, tipo desconocido: gratis. Nunca pagas un escaneo fallido.
- ✓ 10 documentos reconocidos gratis por dirección con la clave pública del sandbox, sin ninguna cuenta, con un máximo de 10 solicitudes por hora, sea cual sea la respuesta.
- ✓ 20 documentos gratis al registrarte, abonados en tu saldo.
Cómo se compara doc.cheap
Precios de lista, cada uno leído en la página de precios del propio proveedor y enlazado a ella. Un proveedor cuyos precios no se pueden leer en sus páginas públicas se deja fuera en lugar de estimarlo: un solo número imposible de verificar restaría valor a toda la tabla. La comparación completa añade cuánto cuesta un escaneo fallido, a cuáles se puede llamar sin cuenta y qué hace mejor cada uno de ellos que nosotros.
| Proveedor | Precio publicado | Gratis para empezar |
|---|---|---|
| doc.cheap | $0.01 por documento, tarifa plana a cualquier volumen | Sandbox público, sin registro |
| AWS Textract – Analyze ID | $0.025 por página hasta 100,000 al mes; $0.01 por página a partir de ahí (us-west-2) fuente | 100 páginas al mes durante los tres primeros meses |
| Google Document AI | $0.10 por documento (analizador de pasaportes de EE. UU.); $0.10 (permiso de conducir) fuente | – |
| Mindee | Créditos adicionales "starting from $0.05", más un recargo del 20 % por exceso de uso fuente | – |
| doc.cheap | $0 – un escaneo que no encuentra ningún documento no se cobra, y la respuesta lo indica en el indicador billed. |
|---|---|
| Los tres anteriores | Ninguna de sus páginas de precios publica una excepción. |
Físicamente no guardamos tus documentos
La imagen que subes vive solo en memoria, mientras dura la solicitud, y nunca se escribe en disco. Lo que se guarda es el resultado – el desenlace y los campos extraídos, nunca una imagen del documento – durante el tiempo que elijas: un año, un mes, una semana, un día o nada en absoluto.
OCR de pasaportes para agentes de IA: el servidor MCP
Un agente que tiene que leer un pasaporte no necesita que le escriban un cliente HTTP. doc.cheap incluye un servidor Model Context Protocol, así que un asistente llama al reconocimiento como una herramienta: le pasa una imagen y recibe los mismos campos estructurados. La misma clave, el mismo precio y la misma forma de respuesta que la API – nada es un producto aparte.
Lo que preguntan los desarrolladores
¿Qué es el OCR en un pasaporte?
El reconocimiento óptico de caracteres lee los caracteres impresos en la fotografía de un documento y los convierte en texto. En un pasaporte hay dos cosas que leer: las dos líneas de la zona de lectura mecánica al pie de la página, impresas en una tipografía diseñada para que la lea una máquina, y la zona de inspección visual que hay encima, que es texto impreso corriente con una disposición distinta en cada emisor.
¿Qué es una MRZ?
Una zona de lectura mecánica (MRZ) es el bloque de líneas de ancho fijo al pie de un pasaporte o documento de identidad, normalizado por el Doc 9303 de ICAO. Codifica el número de documento, el Estado emisor, el nombre, la nacionalidad, la fecha de nacimiento, el sexo y la fecha de caducidad, cada uno en una posición fija, con dígitos de control que verifican la lectura.
¿Qué es el Doc 9303 de ICAO?
El Doc 9303 de ICAO, Machine Readable Travel Documents, es la especificación que siguen todos los pasaportes y documentos de identidad de lectura mecánica. Se publica por partes: la Parte 3 recoge las especificaciones comunes a todos los documentos de viaje de lectura mecánica, y las Partes 4, 5 y 6 recogen el pasaporte TD3, la tarjeta TD1 y la tarjeta TD2, respectivamente. Es lo que hace que un pasaporte emitido en cualquier lugar pueda leerse con un lector fabricado en cualquier otro.
¿La API de OCR de pasaportes comete errores?
Cualquier lectura de una fotografía puede equivocarse, así que la respuesta está hecha para poder comprobarse en lugar de creérsela sin más. Cada zona de lectura mecánica se verifica con sus propios dígitos de control de ICAO 9303 y el veredicto va en la respuesta; cada campo lleva un nivel de confianza; y cuando la zona de lectura mecánica y la zona de inspección visual no coinciden, se devuelven las dos lecturas en lugar de preferir una en silencio.
¿Se guarda alguno de mis datos?
La imagen subida se mantiene en memoria mientras dura la solicitud y nunca se escribe en disco. Lo que puede guardarse es el resultado – el desenlace y los campos extraídos – durante un plazo que eliges para la cuenta o por solicitud, desde un año hasta cero, y cero significa que no se escribe nada en absoluto.
¿Hay pruebas gratuitas o versiones de demostración?
No hay ninguna prueba a la que apuntarse, porque no hay que apuntarse a nada primero. La documentación y el ejemplo de esta página incluyen una clave pública de sandbox que hace reconocimientos reales. Al registrarte recibes documentos gratis en tu saldo; después recargas el saldo y cada documento reconocido descuenta un crédito.
¿Se pueden detectar documentos falsos o manipulados?
No, y la respuesta lo dice en lugar de callarlo: el campo de autenticidad indica not_checked. Este servicio hace reconocimiento, y reconocer no es autenticar: aquí nada inspecciona los elementos de seguridad de un documento. Que los dígitos de control cuadren demuestra que la zona es coherente consigo misma, algo que cualquiera que fabrique una falsificación también consigue; lo que detectan son daños, reflejos y errores de lectura.
¿Qué es un servidor MCP para el procesamiento de documentos?
Model Context Protocol es el estándar con el que un asistente de IA accede a una herramienta. Un servidor MCP para el procesamiento de documentos ofrece el reconocimiento como una herramienta que el asistente puede llamar, así que un agente le pasa la imagen de un pasaporte y recibe campos estructurados sin que nadie escriba código HTTP. doc.cheap incluye uno, y usa la misma clave y el mismo precio que la API.