Extraer tablas de un PDF a Excel
Detecta filas y columnas a partir del texto del PDF y las convierte en una hoja de cálculo. Ideal para estados de cuenta, reportes y listados con columnas bien alineadas.
¡Listo!
Funciona con PDF que tengan texto seleccionable (no escaneados). Para escaneados, usa antes Extraer texto (OCR).
Cómo extraer una tabla a Excel paso a paso
Abre el PDF
Se analiza el texto y su posición en cada página; no hace falta que sea un PDF pequeño.
Ajusta la detección si hace falta
Revisa la vista previa por página y mueve el control de separación de columnas si alguna columna se junta o se divide de más.
Descarga el Excel
Se genera un .xlsx con una hoja por página, lista para revisar y ajustar en Excel o Google Sheets.
Cómo se detecta la tabla
El PDF no «sabe» que tiene una tabla: lo que hay son fragmentos de texto colocados en posiciones concretas de la página. Esta herramienta agrupa esos fragmentos en filas según su altura, y luego agrupa las filas en columnas según en qué posición horizontal empieza cada dato. Cuando las columnas de tu documento están bien alineadas —como suele pasar en los estados de cuenta bancarios, roles de pago o listados de reportes contables—, el resultado es una tabla bastante fiel al original.
Cuándo el resultado no es perfecto
No es un lector con inteligencia artificial: es una heurística basada en posiciones, así que en tablas con celdas combinadas, columnas mal alineadas o texto libre mezclado con la tabla, el resultado puede necesitar ajustes manuales una vez abierto en Excel. El control de «separación entre columnas» existe justamente para esos casos: si dos columnas distintas se están juntando en una sola, sube el valor; si una columna se está partiendo en dos, bájalo. La vista previa se actualiza al momento para que ajustes sin tener que descargar varias veces.
Una hoja por página
El archivo Excel que se descarga trae una hoja de cálculo por cada página del PDF, con el nombre «Página 1», «Página 2», etc. Esto evita mezclar encabezados repetidos de tablas que continúan en varias páginas, algo muy común en estados de cuenta largos.
Si el PDF es un escaneado
Esta herramienta necesita que el PDF tenga texto seleccionable. Si es una foto o un escaneado sin capa de texto, primero pasa por Extraer texto (OCR); después tendrás texto, aunque para tablas complejas en escaneados el resultado seguirá necesitando revisión manual.
El documento no se sube
Igual que el resto de herramientas, la lectura del PDF, la detección de la tabla y la generación del Excel ocurren dentro de tu navegador.