Convertir tablas de PDF a Excel
PDF a Excel encuentra filas de tabla alineadas en el texto de un PDF y escribe cada tabla en su propia hoja de un libro .xlsx. Necesita capa de texto y no devuelve nada para prosa o páginas escaneadas.
Arrastra archivos aquí, o haz clic para elegir
Admite PDF · hasta 500.0 MB por archivo · hasta 20 archivos a la vez
También puedes pegar un archivo con Ctrl/Cmd+V o desde el menú del portapapeles.
PDF a Excel ejecuta `pdftotext -layout`, busca líneas con dos o más espacios seguidos y escribe esas filas en un libro `.xlsx`. Cada tabla detectada es una hoja llamada `Page N` o `Page N Table M`. Encaja en PDF electrónicos cuyas columnas ya están alineadas en el texto extraído.
Hace falta al menos dos filas consecutivas con aspecto de tabla. Prosa, una sola fila de cabecera o un escaneo sin capa de texto dan `no_content`: no hay libro. El resultado vacío es intencional, no un fallo silencioso.
Esta herramienta ignora los parámetros de la petición. Esta página no tiene campo de rango de páginas. Las columnas se parten por dos o más espacios seguidos; un solo espacio dentro de la celda se queda en la celda.
No es OCR. Un escaneo solo imagen no tiene nada que `pdftotext` pueda leer. El OCR de este sitio devuelve Markdown y no se puede reenviar a PDF a Excel. Si las palabras solo existen en píxeles, aquí no hay hoja de cálculo.
PDF a CSV usa la misma heurística de maquetado. Una tabla se convierte en un CSV; varias tablas, en un ZIP de CSV. Excel coloca esas tablas en hojas del mismo libro. Ninguno de los dos restaura celdas combinadas, cabeceras de color u hojas ocultas del PDF.
Abre la descarga en Excel o LibreOffice Calc y comprueba el corte de columnas en unas cuantas filas. Las tablas apretadas sin huecos de doble espacio suelen caer en una sola columna. Los archivos protegidos con contraseña se descifran por ti en esta página cuando introduces la contraseña; quien use la API debe pasar antes por Quitar contraseña.
Las subidas son temporales. No guardamos tu biblioteca de libros.
Funciones
- `pdftotext -layout` más heurística de columnas por doble espacio
- Una hoja por tabla detectada; si no hay detección, no se devuelve archivo
- No es OCR; el Markdown del OCR no se envía aquí
- API anónima: /api/v1/convert/pdf/xlsx
Cuándo usarla
- Abrir tablas extraídas directamente en Excel o LibreOffice Calc
- Llevar a un libro una tabla de factura electrónica
- Dejar cada tabla de varias páginas en su propia hoja en lugar de un CSV
¿Cómo convierto una tabla de PDF a Excel?
- Sube un PDF con texto seleccionable y columnas con aspecto de tabla.
- Pulsa Procesar. Esta herramienta no tiene rango de páginas ni opción OCR.
- Si encuentra tablas, descarga el `.xlsx`. Si no, obtienes un éxito vacío; cambia a una fuente con capa de texto.
- Abre el libro y comprueba el corte. Un PDF solo de prosa no genera hojas.
Límites y casos límite
- Hace falta texto seleccionable y huecos de columna de doble espacio
- Sin OCR y sin control de rango de páginas
- No restaura celdas combinadas ni estilos
- Límite de subida en este sitio web: 500 MB por archivo, enviado por partes a partir de unos 95 MB. El cuerpo de una sola petición directa a la API está limitado a 100 MB.
Ejemplos
- Un PDF de texto con una lista de precios de tres columnas suele convertirse en una hoja con esas columnas
- Un extracto bancario escaneado sin capa de texto no devuelve libro
Privacidad de esta herramienta
Los archivos se suben por HTTPS, se procesan en memoria o en un directorio temporal de corta duración en nuestros servidores, y se eliminan cuando el resultado está listo. No conservamos copias para consultarlas después, entrenar modelos ni crear perfiles publicitarios. Consulte la Política de privacidad para los plazos de retención y las cookies de AdSense.
Preguntas frecuentes
- ¿Por qué no hay hoja de cálculo?
- No se encontraron dos o más filas de tabla consecutivas. Escaneos, prosa y tablas sin huecos de doble espacio hacen fallar la heurística.
- ¿Puedo hacer OCR primero y luego Excel?
- No. El OCR devuelve Markdown. Esta herramienta solo lee el PDF con pdftotext.
- ¿En qué se diferencia de PDF a CSV?
- La detección es la misma. Excel escribe cada tabla en su propia hoja del mismo libro. CSV da un archivo por tabla (uno solo si hay una; ZIP si hay varias).
- ¿Lee cada página?
- Sí. pdftotext pagina por saltos de página. Cada página se escanea en busca de bloques de tabla. No hay parámetro de rango.
Última actualización:
Llámalo desde el código
Cada herramienta del sitio es un endpoint REST. Para uso anónimo no hace falta cuenta ni clave de API. Sirve igual para el navegador, para desarrolladores y para agentes de IA.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
-F "[email protected]" \
-o output.pdfTambién está disponible como herramienta MCP para clientes de agentes que hablan Model Context Protocol (JSON-RPC 2.0 por POST /mcp). Referencia completa de la API
Úsalo desde un agente de IA
SkillCon esta skill, Claude Code, Codex, Cursor y otros agentes de IA pueden usar «PDF a Excel» por ti: /skills/pdf123-pdf-to-xlsx.md
Los archivos se usan solo para este trabajo y se borran automáticamente después.