Ir al contenido principal
PPDF123

Convertir tablas de PDF a Excel

PDF a Excel encuentra filas de tabla alineadas en el texto de un PDF y escribe cada tabla en su propia hoja de un libro .xlsx. Necesita capa de texto y no devuelve nada para prosa o páginas escaneadas.

Arrastra archivos aquí, o haz clic para elegir

Admite PDF · hasta 500.0 MB por archivo · hasta 20 archivos a la vez

También puedes pegar un archivo con Ctrl/Cmd+V o desde el menú del portapapeles.

PDF a Excel ejecuta `pdftotext -layout`, busca líneas con dos o más espacios seguidos y escribe esas filas en un libro `.xlsx`. Cada tabla detectada es una hoja llamada `Page N` o `Page N Table M`. Encaja en PDF electrónicos cuyas columnas ya están alineadas en el texto extraído.

Hace falta al menos dos filas consecutivas con aspecto de tabla. Prosa, una sola fila de cabecera o un escaneo sin capa de texto dan `no_content`: no hay libro. El resultado vacío es intencional, no un fallo silencioso.

Esta herramienta ignora los parámetros de la petición. Esta página no tiene campo de rango de páginas. Las columnas se parten por dos o más espacios seguidos; un solo espacio dentro de la celda se queda en la celda.

No es OCR. Un escaneo solo imagen no tiene nada que `pdftotext` pueda leer. El OCR de este sitio devuelve Markdown y no se puede reenviar a PDF a Excel. Si las palabras solo existen en píxeles, aquí no hay hoja de cálculo.

PDF a CSV usa la misma heurística de maquetado. Una tabla se convierte en un CSV; varias tablas, en un ZIP de CSV. Excel coloca esas tablas en hojas del mismo libro. Ninguno de los dos restaura celdas combinadas, cabeceras de color u hojas ocultas del PDF.

Abre la descarga en Excel o LibreOffice Calc y comprueba el corte de columnas en unas cuantas filas. Las tablas apretadas sin huecos de doble espacio suelen caer en una sola columna. Los archivos protegidos con contraseña se descifran por ti en esta página cuando introduces la contraseña; quien use la API debe pasar antes por Quitar contraseña.

La regla de los dos espacios es todo el mecanismo de detección, así que la calidad del libro depende por completo de cómo se maquetó el PDF. Las tablas de generadores de informes que rellenan cada celda a un ancho fijo se extraen limpiamente. Las tablas con un solo espacio entre columnas, o con fuentes proporcionales que dejan las columnas casi pegadas, no se registran como tablas y pueden no producir ningún libro. Antes de culpar a la herramienta, selecciona una fila del PDF y confirma que el texto es seleccionable.

El nombre de las hojas sigue la posición, no el contenido. Cada bloque detectado se convierte en `Page N` o `Page N Table M`, en el orden en que se escanean las páginas. Un informe con una tabla en cada página produce una hoja por página; una página con tres tablas apiladas produce tres hojas numeradas. No hay opción de nombrar las hojas según una celda de cabecera, ni una salida combinada en una sola hoja.

Los valores se escriben como texto, exactamente como aparecieron en la extracción que conserva la maquetación. Los números no se convierten en celdas numéricas, así que los ceros iniciales se conservan y los símbolos de moneda y los separadores de millares permanecen en la cadena. Suele ser lo que quieres para números de cuenta y códigos postales, y algo molesto para una columna de importes que piensas sumar. Convierte los tipos en la hoja de cálculo, o copia la columna y usa texto en columnas o la conversión de valores del programa de destino.

Las filas no se deduplican y las cabeceras repetidas no se eliminan. Cuando una tabla se parte en un salto de página, la fila de cabecera suele repetirse en la página siguiente y la continuación se convierte en su propia hoja. Las celdas combinadas no se reconstruyen; una celda que abarcaba dos columnas en el PDF simplemente tiene su texto en la columna más a la izquierda y la derecha queda vacía. Las celdas de varias líneas se convierten en filas separadas en lugar de un valor ajustado.

Las subidas son temporales. No guardamos tu biblioteca de libros.

Funciones

  • `pdftotext -layout` más heurística de columnas por doble espacio
  • Una hoja por tabla detectada; si no hay detección, no se devuelve archivo
  • No es OCR; el Markdown del OCR no se envía aquí
  • Celdas con tipo texto; sin inferencia de tipos ni reconstrucción de celdas combinadas
  • API anónima: /api/v1/convert/pdf/xlsx

Cuándo usarla

  • Abrir tablas extraídas directamente en Excel o LibreOffice Calc
  • Llevar a un libro una tabla de factura electrónica
  • Dejar cada tabla de varias páginas en su propia hoja en lugar de un CSV
  • Extraer un estado financiero de ancho fijo para analizarlo mejor

¿Cómo convierto una tabla de PDF a Excel?

  1. Sube un PDF que ya tenga texto seleccionable en columnas con aspecto de tabla.
  2. Pulsa Procesar. Esta herramienta no tiene rango de páginas ni opción OCR.
  3. Si encuentra tablas, descarga el `.xlsx`. Si no, obtienes un éxito vacío; cambia a una fuente con capa de texto.
  4. Abre el libro y comprueba el corte. Un PDF solo de prosa no genera hojas.

Límites y casos límite

  • Hace falta texto seleccionable y huecos de columna de doble espacio
  • Sin OCR y sin control de rango de páginas
  • No restaura celdas combinadas ni estilos
  • Todos los valores son texto; sin tipado numérico ni de fecha
  • Las tablas que ocupan varias páginas se convierten en hojas separadas
  • Límite de subida en este sitio web: 500 MB por archivo, enviado por partes a partir de unos 95 MB. El cuerpo de una sola petición directa a la API está limitado a 100 MB.

Ejemplos

  • Un PDF de texto con una lista de precios de tres columnas suele convertirse en una hoja con esas columnas
  • Un extracto bancario escaneado sin capa de texto no devuelve libro
  • Un informe de diez páginas con una tabla por página da diez hojas de Page 1 a Page 10

Privacidad de esta herramienta

Los archivos se suben por HTTPS, se procesan en memoria o en un directorio temporal de corta duración en nuestros servidores, y se eliminan cuando el resultado está listo. No conservamos copias para consultarlas después, entrenar modelos ni crear perfiles publicitarios. Consulte la Política de privacidad para los plazos de retención y las cookies de AdSense.

Preguntas frecuentes

¿Por qué no obtuve hoja de cálculo?
No se encontró ningún bloque de dos o más filas de tabla consecutivas. Escaneos, prosa y tablas sin huecos de doble espacio hacen fallar la heurística.
¿Puedo hacer OCR primero y luego convertir a Excel?
No. El OCR devuelve Markdown. Esta herramienta solo lee el PDF con pdftotext.
¿En qué se diferencia de PDF a CSV?
La detección es la misma. Excel escribe cada tabla en su propia hoja del mismo libro. CSV da un archivo por tabla (uno solo si hay una; ZIP si hay varias).
¿Lee cada página?
Sí. pdftotext pagina por saltos de página. Cada página se escanea en busca de bloques de tabla. No hay parámetro de rango.
¿Por qué mis números se guardan como texto?
Los valores se escriben exactamente como se extrajeron, así que los ceros iniciales y el formato se conservan. Convierte la columna a numérica en la hoja de cálculo si necesitas calcular con ella.
¿Se reconstruyen las celdas combinadas?
No. El texto de una celda combinada va a la columna más a la izquierda y las demás quedan vacías. Las celdas de varias líneas se convierten en filas separadas en lugar de un valor ajustado.
¿Por qué tengo varias hojas para una misma tabla?
Una tabla que continúa en una página nueva se detecta otra vez allí y se convierte en otra hoja. Las filas de cabecera suelen repetirse; la herramienta no une los fragmentos.

Última actualización:

Llámalo desde el código

Cada herramienta del sitio es un endpoint REST. Para uso anónimo no hace falta cuenta ni clave de API. Sirve igual para el navegador, para desarrolladores y para agentes de IA.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

También está disponible como herramienta MCP para clientes de agentes que hablan Model Context Protocol (JSON-RPC 2.0 por POST /mcp). Referencia completa de la API

Úsalo desde un agente de IA

Skill

Con esta skill, Claude Code, Codex, Cursor y otros agentes de IA pueden usar «PDF a Excel» por ti: /skills/pdf123-pdf-to-xlsx.md

Todas las skills para agentes

Los archivos se usan solo para este trabajo y se borran automáticamente después.