PDF a Excel

Extraer tablas de un PDF a Excel

Detecta filas y columnas a partir del texto del PDF y las convierte en una hoja de cálculo. Ideal para estados de cuenta, reportes y listados con columnas bien alineadas.

Suelta aquí tu PDF un estado de cuenta, reporte o listado con tablas Seleccionar PDF
archivo
Súbela si columnas distintas se están juntando; bájala si una columna se está partiendo en dos.
Procesando…

¡Listo!

⚠️Algo ha fallado.
100 % privado. Tus archivos se procesan dentro de tu navegador y no se suben a ningún servidor nuestro.

Funciona con PDF que tengan texto seleccionable (no escaneados). Para escaneados, usa antes Extraer texto (OCR).

Cómo extraer una tabla a Excel paso a paso

1

Abre el PDF

Se analiza el texto y su posición en cada página; no hace falta que sea un PDF pequeño.

2

Ajusta la detección si hace falta

Revisa la vista previa por página y mueve el control de separación de columnas si alguna columna se junta o se divide de más.

3

Descarga el Excel

Se genera un .xlsx con una hoja por página, lista para revisar y ajustar en Excel o Google Sheets.

Cómo se detecta la tabla

El PDF no «sabe» que tiene una tabla: lo que hay son fragmentos de texto colocados en posiciones concretas de la página. Esta herramienta agrupa esos fragmentos en filas según su altura, y luego agrupa las filas en columnas según en qué posición horizontal empieza cada dato. Cuando las columnas de tu documento están bien alineadas —como suele pasar en los estados de cuenta bancarios, roles de pago o listados de reportes contables—, el resultado es una tabla bastante fiel al original.

Cuándo el resultado no es perfecto

No es un lector con inteligencia artificial: es una heurística basada en posiciones, así que en tablas con celdas combinadas, columnas mal alineadas o texto libre mezclado con la tabla, el resultado puede necesitar ajustes manuales una vez abierto en Excel. El control de «separación entre columnas» existe justamente para esos casos: si dos columnas distintas se están juntando en una sola, sube el valor; si una columna se está partiendo en dos, bájalo. La vista previa se actualiza al momento para que ajustes sin tener que descargar varias veces.

Una hoja por página

El archivo Excel que se descarga trae una hoja de cálculo por cada página del PDF, con el nombre «Página 1», «Página 2», etc. Esto evita mezclar encabezados repetidos de tablas que continúan en varias páginas, algo muy común en estados de cuenta largos.

Si el PDF es un escaneado

Esta herramienta necesita que el PDF tenga texto seleccionable. Si es una foto o un escaneado sin capa de texto, primero pasa por Extraer texto (OCR); después tendrás texto, aunque para tablas complejas en escaneados el resultado seguirá necesitando revisión manual.

El documento no se sube

Igual que el resto de herramientas, la lectura del PDF, la detección de la tabla y la generación del Excel ocurren dentro de tu navegador.

Preguntas frecuentes

¿Funciona con estados de cuenta bancarios?
En la mayoría de los casos sí, porque suelen tener columnas bien alineadas (fecha, descripción, monto). Revisa siempre la vista previa antes de descargar.
¿Por qué se juntan dos columnas en una?
Porque la separación horizontal entre esas columnas es menor que el valor de «separación entre columnas». Sube ese control hasta que se separen.
¿Por qué se parte una columna en dos?
Por lo contrario: el valor es demasiado alto y una sola columna con texto de distinto ancho se está interpretando como dos. Bájalo.
¿Funciona con PDF escaneados?
No directamente: necesita texto seleccionable. Pasa primero el documento por Extraer texto (OCR).
¿Por qué se genera una hoja por página en vez de una sola tabla?
Porque en documentos de varias páginas cada una suele repetir sus propios encabezados de columna; separarlas evita mezclar datos de tablas distintas. Puedes unir las hojas tú mismo en Excel si tu documento es en realidad una sola tabla continua.
¿Se sube mi documento a algún servidor?
No. La lectura del PDF y la generación del Excel ocurren enteramente en tu navegador.