Una hoja por página del PDF
MakeFileWork infiere columnas estables, reconoce columnas numéricas y ahora detecta tanto grandes separaciones visuales como cambios persistentes en la estructura de columnas entre tablas independientes de una misma página. Una página con secciones distintas puede convertirse en varias hojas claramente nombradas en vez de forzarse a una única cuadrícula deformada. Dentro de cada región detectada, los valores ausentes conservan su columna vacía correcta, reduciendo desplazamientos en extractos, facturas e informes.
OCR automático para escaneos
Si no existe una capa de texto útil, el motor OCR EN+ES conserva la posición de cada palabra reconocida y pasa esa geometría al mismo motor de inferencia de columnas usado con PDF buscables. Así se mantienen mucho mejor las columnas que convirtiendo primero el OCR en líneas de texto plano. El fallback OCR está limitado actualmente a 20 MB y 20 páginas.
Extracción de tablas sin promesas falsas
Un PDF guarda la apariencia de la página, no la semántica de una hoja de cálculo. Celdas combinadas, tablas irregulares o diseños complejos pueden necesitar limpieza posterior en Excel.