Utilidades avanzadas

Extraer tablas de un PDF a Excel

Sube un PDF con tablas y descarga una planilla de Excel con las filas y columnas reconstruidas.

Gratis, sin límite de usos Nada se guarda en disco .pdf

Formatos aceptados: .pdf

Por ejemplo «1-3,5». Déjalo vacío para todas.

Cómo reconstruye la tabla

Conviene ser honesto desde el principio: un PDF no guarda «tablas», guarda letras con coordenadas. No hay una rejilla escondida esperando a que la lean; hay palabras sueltas con una posición en la página.

Por eso la herramienta reconstruye la tabla con una heurística: agrupa las palabras que comparten la misma línea de base para formar cada fila y, dentro de la fila, corta una columna nueva allí donde el hueco horizontal entre dos palabras es lo bastante grande. Funciona bien con tablas alineadas y se degrada con elegancia con las que no lo están. Como es una reconstrucción y no una lectura exacta, el resultado siempre viene con un aviso para que revises las columnas antes de darlas por buenas.

Los títulos que verás son sintéticos —«Columna 1», «Columna 2»…— porque el PDF no dice cuál es la cabecera. Si la primera fila era el encabezado real, quedará como primera fila de datos y podrás promoverla tú.

No hace OCR

Esto es importante: la herramienta lee el texto que el PDF ya contiene, no reconoce imágenes. Un PDF escaneado —una foto o un documento pasado por el escáner— no tiene texto, solo un mapa de píxeles. En ese caso no hay nada que extraer y la herramienta te lo dice en vez de devolver una planilla vacía sin explicación.

La prueba rápida: si en el PDF puedes seleccionar el texto con el ratón, aquí se extrae; si al arrastrar seleccionas la imagen entera, es un escaneo.

Opciones

  • Páginas: por defecto se procesan todas. Puedes acotar con un rango como «1-3,5», que toma las páginas 1, 2, 3 y 5. Lo que caiga fuera del documento se ignora en vez de fallar.
  • Una hoja por página: desactivada, todas las páginas se apilan en una sola tabla continua; activada, cada página va a su propia hoja. Útil si cada página es una tabla independiente.
  • Detectar números y fechas: activada, un «1.234,50» se guarda como número y una fecha como fecha, respetando tu configuración regional. Desactívala si prefieres que todo se conserve como texto tal cual.

Preguntas frecuentes

¿Por qué las columnas salen descuadradas?

Porque la tabla original no estaba bien alineada. La herramienta separa columnas por los huecos horizontales; si dos columnas van muy juntas o una celda se desborda, el corte cae donde no toca. En tablas con márgenes claros esto casi no pasa.

¿Puedo extraer solo unas páginas?

Sí. Escribe el rango en la opción «Páginas», por ejemplo «2-4» o «1,3,7». Es la forma de saltarte portadas, índices y páginas sin tablas.

¿Sirve para un PDF escaneado?

No. Un escaneo es una imagen sin texto y esta herramienta no hace OCR. Necesitas antes un programa de reconocimiento óptico que convierta la imagen en texto.

¿Los títulos «Columna 1, 2…» son un error?

No, son intencionados. El PDF no marca cuál es la cabecera, así que se ponen títulos neutros y estables. Si tu primera fila era el encabezado, quedará como fila de datos y puedes usarla como tal.

¿Y si el resultado no queda perfecto?

Es lo esperable con algunas tablas: la reconstrucción es una aproximación, por eso siempre verás el aviso. Suele ser mucho más rápido corregir un par de columnas que teclear la tabla entera a mano.