Convertir PDF a XML
PDF a XML importa un PDF con LibreOffice y devuelve un archivo XML de estilo Office. Es una exportación de texto y maquetación aproximada, no una copia de la estructura ni de las etiquetas del PDF.
Arrastra archivos aquí, o haz clic para elegir
Admite PDF · hasta 500.0 MB por archivo · hasta 20 archivos a la vez
También puedes pegar un archivo con Ctrl/Cmd+V o desde el menú del portapapeles.
PDF a XML mete el archivo en LibreOffice `writer_pdf_import` con `outputFormat=xml`. La descarga es XML al estilo Office (`octet-stream`), no un volcado del flujo interno del PDF ni una reconstrucción de tagged-PDF.
Es la misma familia de importación LibreOffice que PDF a Word, pero el destino es XML. Maquetación, tablas y fuentes van a ciegas. Un escaneo sin capa de texto acaba en imágenes o párrafos vacíos.
Esta página no tiene opciones. Los archivos protegidos con contraseña se descifran por ti en esta página cuando introduces la contraseña; quien use la API debe pasar antes por Quitar contraseña. El Markdown del OCR no entra aquí.
Si quieres filas de una tabla, usa PDF a CSV. Si solo quieres palabras, usa PDF a RTF (texto).
La subida es temporal. No guardamos tu biblioteca de XML.
Funciones
- LibreOffice `writer_pdf_import` a XML
- No es exportación de estructura PDF ni OCR
- Sin intervalo de páginas ni esquema
- API anónima: /api/v1/convert/pdf/xml
Cuándo usarla
- Entregar un PDF digital a una tubería que ya recibe XML de Office
- Ver cómo parte LibreOffice este documento
- Sacar un borrador XML cuando el siguiente paso no es DOCX
¿Cómo convierto un PDF a XML?
- Sube un PDF con texto.
- Pulsa Procesar. Esta página no tiene opciones de formato.
- Descarga el `.xml`.
- Ábrelo en LibreOffice o en un editor y trátalo como borrador.
Límites y casos límite
- No es tagged-PDF ni extracción XFDF/XFA
- No es OCR
- Tablas y saltos de página no coincidirán con el PDF
- Límite de subida en este sitio web: 500 MB por archivo, enviado por partes a partir de unos 95 MB. El cuerpo de una sola petición directa a la API está limitado a 100 MB.
Ejemplos
- Un memorándum de texto suele convertirse en un XML de Office grande con runs de párrafo
- Un PDF solo escaneo suele dar XML que envuelve sobre todo imágenes
Privacidad de esta herramienta
Los archivos se suben por HTTPS, se procesan en memoria o en un directorio temporal de corta duración en nuestros servidores, y se eliminan cuando el resultado está listo. No conservamos copias para consultarlas después, entrenar modelos ni crear perfiles publicitarios. Consulte la Política de privacidad para los plazos de retención y las cookies de AdSense.
Preguntas frecuentes
- ¿Es el XML interno del PDF?
- No. Es LibreOffice exportando el documento importado a XML, no el árbol de objetos PDF.
- ¿Por qué un escaneo sale casi vacío?
- LibreOffice no tiene texto que importar. El texto en píxeles va a OCR a Markdown.
- ¿Puedo elegir otro dialecto XML?
- No. Esta ruta fija outputFormat en xml y solo admite ese valor.
- ¿En qué se diferencia de PDF a Word?
- El importador es el mismo; el producto no. PDF a Word da docx, doc u odt. Esta ruta da xml.
Última actualización:
Llámalo desde el código
Cada herramienta del sitio es un endpoint REST. Para uso anónimo no hace falta cuenta ni clave de API. Sirve igual para el navegador, para desarrolladores y para agentes de IA.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xml" \
-F "[email protected]" \
-o output.pdfTambién está disponible como herramienta MCP para clientes de agentes que hablan Model Context Protocol (JSON-RPC 2.0 por POST /mcp). Referencia completa de la API
Úsalo desde un agente de IA
SkillCon esta skill, Claude Code, Codex, Cursor y otros agentes de IA pueden usar «PDF a XML» por ti: /skills/pdf123-pdf-to-xml.md
Los archivos se usan solo para este trabajo y se borran automáticamente después.