¿Por qué la IA se equivoca con una tabla de mi PDF?
Una tabla en PDF puede verse perfecta y extraerse en el orden equivocado. Aprende qué falla, dónde ayuda el OCR y cómo revisar los números importantes.
Le haces una pregunta a una IA sobre una tabla en un PDF. Responde con seguridad, pero un número quedó asociado al mes equivocado. O el total parece correcto, aunque falta una fila. El PDF se ve normal. El problema apareció durante la extracción.
Esto ocurre porque una tabla en PDF suele ser un diseño visual, no una hoja de cálculo. La página muestra filas y columnas a tus ojos. La capa de texto puede guardar esas palabras como una secuencia suelta de fragmentos colocados en distintas posiciones.
La tabla parece estructurada para ti, no necesariamente para el extractor
Al crear un PDF, cada fragmento de texto recibe una posición en la página. Un encabezado, el valor de una celda y una nota al pie pueden ser objetos separados. El archivo puede recordar dónde se dibujaron sin recordar que uno pertenece a la columna tres, fila siete.
El extractor intenta reconstruir esa relación usando coordenadas. Si dos columnas están muy cerca, una fila se ajusta o un encabezado se repite en la página siguiente, el orden de lectura puede cambiar. El resultado sigue siendo legible para una persona, pero deja de ser una tabla fiable.
Cuatro formas habituales de leer mal una tabla
- Las columnas se mezclan. Los valores de dos columnas cercanas aparecen como un solo flujo de texto.
- Las filas se ajustan de forma inesperada. Una etiqueta larga empuja el valor a la línea siguiente y la IA lo asocia con la fila equivocada.
- Los encabezados se repiten sin contexto. Un salto de página añade otro encabezado, pero el texto extraído no deja clara la división.
- Las notas parecen datos. Una nota al pie o un subtotal puede parecer otro registro, sobre todo si usa la misma fuente y alineación.
Las tablas escaneadas añaden otro problema. Puede que no exista una capa de texto, así que el OCR tiene que adivinar los caracteres y sus posiciones antes de que la IA vea el documento.
Por qué el OCR no resuelve todas las tablas
El OCR ayuda cuando un PDF es solo una imagen de la página. Convierte las letras visibles en texto seleccionable, lo que ya es una mejora. Pero OCR no es lo mismo que reconstruir una hoja de cálculo. Bordes, celdas combinadas, celdas vacías, superíndices y encabezados de varias líneas todavía pueden perder su significado.
Por eso un resultado de OCR puede servir para buscar y seguir siendo inseguro para hacer un cálculo. Si la pregunta depende de un total exacto, compara la respuesta con la página renderizada.
Una comprobación práctica antes de confiar en una respuesta
- Pide a la IA que indique la página y la fila usada para cada número importante.
- Abre esa página y sigue la fila completa, no solo el valor.
- Vuelve a calcular los totales si el resultado afecta a dinero, cumplimiento o decisiones.
- Prueba otra extracción si el orden parece extraño o las columnas se han unido.
Puedes inspeccionar la capa de texto localmente con PDF a Markdown. Puede añadir OCR para páginas escaneadas, pero el resultado sigue siendo una extracción. Trátalo como una copia de trabajo, no como una prueba de que la estructura de la tabla se conservó perfectamente.
Los tokens pueden ocultar el problema
Una tabla rota puede tener un recuento de tokens perfectamente normal. Las palabras siguen ahí, así que el Contador de Tokens de PDF puede mostrar un número plausible. El recuento indica cuánto texto puede recibir la IA. No indica si las columnas están asociadas correctamente.
La misma diferencia importa para el coste. La Calculadora de Coste de Tokens estima cuánto cuesta enviar el PDF extraído, pero una factura menor no hace más fiable una tabla dañada.
En resumen
La IA puede equivocarse con una tabla aunque el PDF parezca perfecto porque el diseño visual y el orden del texto son cosas distintas. Extrae el texto, revisa las filas, verifica los números importantes con la página y usa OCR como un paso útil, no como una garantía. En las tablas importantes, la comprobación final todavía corresponde a una persona.