Ir al contenido principal
PPDF123

Convertir PDF a XML

PDF a XML importa un PDF con LibreOffice y devuelve un archivo XML de estilo Office. Es una exportación de texto y maquetación aproximada, no una copia de la estructura ni de las etiquetas del PDF.

Arrastra archivos aquí, o haz clic para elegir

Admite PDF · hasta 500.0 MB por archivo · hasta 20 archivos a la vez

También puedes pegar un archivo con Ctrl/Cmd+V o desde el menú del portapapeles.

PDF a XML mete el archivo en LibreOffice `writer_pdf_import` con `outputFormat=xml`. La descarga es XML al estilo Office (`octet-stream`), no un volcado del flujo interno del PDF ni una reconstrucción de tagged-PDF.

Es la misma familia de importación LibreOffice que PDF a Word, pero el destino es XML. Maquetación, tablas y fuentes van a ciegas. Un escaneo sin capa de texto acaba en imágenes o párrafos vacíos.

Esta página no tiene opciones. Los archivos protegidos con contraseña se descifran por ti en esta página cuando introduces la contraseña; quien use la API debe pasar antes por Quitar contraseña. El Markdown del OCR no entra aquí.

Si quieres filas de una tabla, usa PDF a CSV. Si solo quieres palabras, usa PDF a RTF (texto).

La subida es temporal. No guardamos tu biblioteca de XML.

Funciones

  • LibreOffice `writer_pdf_import` a XML
  • No es exportación de estructura PDF ni OCR
  • Sin intervalo de páginas ni esquema
  • API anónima: /api/v1/convert/pdf/xml

Cuándo usarla

  • Entregar un PDF digital a una tubería que ya recibe XML de Office
  • Ver cómo parte LibreOffice este documento
  • Sacar un borrador XML cuando el siguiente paso no es DOCX

¿Cómo convierto un PDF a XML?

  1. Sube un PDF con texto.
  2. Pulsa Procesar. Esta página no tiene opciones de formato.
  3. Descarga el `.xml`.
  4. Ábrelo en LibreOffice o en un editor y trátalo como borrador.

Límites y casos límite

  • No es tagged-PDF ni extracción XFDF/XFA
  • No es OCR
  • Tablas y saltos de página no coincidirán con el PDF
  • Límite de subida en este sitio web: 500 MB por archivo, enviado por partes a partir de unos 95 MB. El cuerpo de una sola petición directa a la API está limitado a 100 MB.

Ejemplos

  • Un memorándum de texto suele convertirse en un XML de Office grande con runs de párrafo
  • Un PDF solo escaneo suele dar XML que envuelve sobre todo imágenes

Privacidad de esta herramienta

Los archivos se suben por HTTPS, se procesan en memoria o en un directorio temporal de corta duración en nuestros servidores, y se eliminan cuando el resultado está listo. No conservamos copias para consultarlas después, entrenar modelos ni crear perfiles publicitarios. Consulte la Política de privacidad para los plazos de retención y las cookies de AdSense.

Preguntas frecuentes

¿Es el XML interno del PDF?
No. Es LibreOffice exportando el documento importado a XML, no el árbol de objetos PDF.
¿Por qué un escaneo sale casi vacío?
LibreOffice no tiene texto que importar. El texto en píxeles va a OCR a Markdown.
¿Puedo elegir otro dialecto XML?
No. Esta ruta fija outputFormat en xml y solo admite ese valor.
¿En qué se diferencia de PDF a Word?
El importador es el mismo; el producto no. PDF a Word da docx, doc u odt. Esta ruta da xml.

Última actualización:

Llámalo desde el código

Cada herramienta del sitio es un endpoint REST. Para uso anónimo no hace falta cuenta ni clave de API. Sirve igual para el navegador, para desarrolladores y para agentes de IA.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
  -F "[email protected]" \
  -o output.pdf

También está disponible como herramienta MCP para clientes de agentes que hablan Model Context Protocol (JSON-RPC 2.0 por POST /mcp). Referencia completa de la API

Úsalo desde un agente de IA

Skill

Con esta skill, Claude Code, Codex, Cursor y otros agentes de IA pueden usar «PDF a XML» por ti: /skills/pdf123-pdf-to-xml.md

Todas las skills para agentes

Los archivos se usan solo para este trabajo y se borran automáticamente después.