Errores Comunes al Escanear Pasaportes (y Cómo Evitarlos)
Las causas reales por las que falla la lectura automática de un pasaporte —reflejo en la laminación, recorte de la MRZ, resolución insuficiente— y cómo corregir cada una en la captura.
Cuando la lectura automática de un pasaporte falla, la causa casi nunca es el documento ni el motor de OCR: es cómo se tomó la foto. Y como el pasaporte se auto-verifica con sus dígitos, el fallo suele ser honesto —el sistema avisa que no pudo leer— en lugar de silencioso.
Esta es la lista de causas, ordenada por frecuencia, con la corrección de cada una.
1. Reflejo sobre la laminación
La causa número uno, por bastante margen. La página de datos de un pasaporte está laminada y suele llevar elementos holográficos diseñados precisamente para reflejar la luz. Un flash frontal rebota justo sobre las dos líneas de la MRZ y las borra.
Lo delator: el resto de la página se lee perfectamente y solo falla la franja inferior.
Corrección:
- Apaga el flash. Casi siempre empeora las cosas con documentos laminados.
- Inclina el documento 10 o 15 grados, o muévete tú. El reflejo es especular: un cambio pequeño de ángulo lo desplaza fuera del texto.
- Luz difusa y lateral — junto a una ventana funciona mejor que cualquier lámpara apuntando de frente.
2. La MRZ recortada
El segundo error más común y el más fácil de evitar. El usuario encuadra "el pasaporte" centrando la foto y el nombre, y deja fuera —o parcialmente fuera— las dos líneas del pie.
Sin MRZ completa no hay validación por dígitos verificadores. Se puede leer la zona visual, pero pierdes la comprobación aritmética que hace confiable el resultado.
Corrección: encuadra la página completa, con margen visible por los cuatro lados. En una interfaz de captura, dibuja una guía con la proporción de la página de datos y marca explícitamente dónde deben quedar las dos líneas inferiores. Un recuadro sombreado sobre la zona MRZ, con el texto "estas dos líneas deben verse completas", elimina casi todos estos casos.
3. Resolución insuficiente
Los caracteres de la MRZ son pequeños: 44 por línea a lo ancho de la página. Cuando la imagen tiene poca resolución, cada carácter queda con muy pocos píxeles y las distinciones finas —0 contra O, 1 contra I— se vuelven imposibles.
Corrección: apunta a 1200 píxeles de ancho como mínimo para la página de datos; 1600 o más es cómodo. Cuidado con dos trampas frecuentes:
- La compresión del canal de mensajería. Un pasaporte que llega por WhatsApp puede venir a 800 px de ancho y con artefactos de JPEG. Si tu flujo recibe documentos por ahí, pide el archivo original.
- El redimensionado del cliente. Muchas apps encogen la imagen antes de subirla para "ahorrar ancho de banda". Con 10 MB de límite no hace falta: manda la foto completa.
Y una advertencia contraintuitiva: ampliar una imagen pequeña no recupera información. Si tu pipeline hace upscaling antes de enviar, puedes estar degradando una imagen que ya era legible. Manda los bytes originales.
4. Sombras y luz irregular
La sombra del propio teléfono, o de la mano que sostiene el documento, cayendo sobre parte de la página. El OCR lee bien la mitad iluminada y falla en la otra.
Corrección: luz que venga de detrás o del costado de la cámara, no de enfrente. Si tomas la foto desde arriba con el documento en una mesa, fíjate en dónde cae tu propia sombra.
5. Rotación pronunciada y perspectiva
La MRZ se lee como dos líneas horizontales. Un documento muy inclinado, o fotografiado en ángulo de modo que la página salga como un trapecio, complica la segmentación de esas líneas.
Corrección: la cámara paralela a la página, no en diagonal. Una rotación leve se corrige sola; un ángulo de 30 grados no.
6. Foto de una pantalla
Alguien abre el PDF del pasaporte en una laptop y le toma foto a la pantalla. El resultado trae moiré, bandas y reflejo — la peor combinación posible.
Corrección: si el documento ya es digital, súbelo como archivo. La API acepta el envío por URL o en base64 precisamente para que un documento que ya nació digital nunca tenga que pasar por una cámara.
7. Pasaportes desgastados
El caso legítimo: documentos de ocho o nueve años de uso, con la laminación rayada justo sobre la MRZ, o dobleces que cruzan las líneas.
Aquí sí hay un límite físico. Si los caracteres no están, no hay motor que los invente — y preferimos decírtelo antes que devolverte un número de pasaporte inventado. Cuando la MRZ está dañada, la zona visual de la página sigue siendo legible y sirve para capturar los datos con revisión manual.
Cómo se ve un fallo bien manejado
Nuestra API devuelve 422 LOW_IMAGE_QUALITY cuando la imagen no permite una lectura que verifique, con la lista de campos que no se pudieron leer:
{
"success": false,
"code": "LOW_IMAGE_QUALITY",
"missing_fields": ["mrzLine2"],
"extraction_id": "clx7f2k..."
}
Y el token se reembolsa: una imagen ilegible no consume saldo.
Ese missing_fields es lo que convierte un error en una instrucción. En vez de "error al procesar el documento", tu interfaz puede decir:
No se pudieron leer las dos líneas del pie del pasaporte. Vuelve a tomar la foto asegurándote de que aparezcan completas y sin reflejo.
Es la diferencia entre un usuario que reintenta con éxito y uno que abandona.
La lista, en un recuadro
Si vas a poner instrucciones en tu pantalla de captura, estas cinco resuelven la gran mayoría de los casos:
- Página completa, con las dos líneas del pie visibles
- Sin flash
- Luz lateral, sin sombras encima
- Cámara paralela al documento
- La foto original, sin recortar ni comprimir
Pruébalo
La demo gratuita procesa un pasaporte sin registro: es la forma rápida de ver cómo responde el sistema a tus propias condiciones de captura. Si ya tienes una MRZ transcrita y quieres comprobar si es coherente, el validador MRZ recalcula los dígitos verificadores gratis.
Para el manejo de estos casos en código, con reintentos y códigos de error, está Cómo integrar una API de OCR de pasaporte.
¿Necesitas extraer datos de pasaportes automáticamente?
Prueba nuestra API con 20 extracciones gratis. Integración en minutos, resultados en segundos.
Comenzar gratis