Convertir PDF a texto
PDF a RTF (texto) extrae el texto que ya existe en un PDF y lo devuelve como archivo .txt sin formato o como RTF. No ejecuta OCR, así que los escaneos de solo imagen salen vacíos.
Arrastra archivos aquí, o haz clic para elegir
Admite PDF · hasta 500.0 MB por archivo · hasta 20 archivos a la vez
También puedes pegar un archivo con Ctrl/Cmd+V o desde el menú del portapapeles.
PDF a RTF (texto) extrae las palabras que ya existen como objetos de texto. La ruta por defecto `txt` usa el extractor nativo de pdf-core (`pdfio::extract_text`) y devuelve `text/plain`. No hay OCR ni LibreOffice.
Si eliges `rtf`, el archivo pasa por LibreOffice `writer_pdf_import`. Esa ruta necesita `soffice` en el servidor y reconstruye un RTF tosco. Sustitución de fuentes y tablas descentradas son lo habitual. Trátalo como borrador.
Un escaneo solo imagen suele dar un `.txt` vacío o casi vacío. El OCR de este sitio devuelve Markdown, no un PDF buscable que puedas reenviar aquí.
Esta página no tiene intervalo de páginas. Se lee todo. Los archivos protegidos con contraseña se descifran por ti en esta página cuando introduces la contraseña; quien use la API debe pasar antes por Quitar contraseña.
Si quieres títulos y listas en vez de texto plano, usa PDF a Markdown. Si quieres tablas en filas, usa PDF a CSV o PDF a Excel.
La subida es temporal. No guardamos tu biblioteca de texto.
Funciones
- TXT por defecto: extracción nativa, no pdftotext ni OCR
- RTF opcional vía LibreOffice `writer_pdf_import`
- Lee todas las páginas; no hay parámetro de intervalo
- API anónima: /api/v1/convert/pdf/text
Cuándo usarla
- Volcar un informe con capa de texto a grep o a un script
- Sacar un borrador RTF tosco de un memorándum digital
- Comprobar si un PDF tiene capa de texto de verdad
¿Cómo extraigo el texto de un PDF?
- Sube un PDF con texto seleccionable.
- Deja TXT, o elige RTF si quieres un borrador enriquecido de LibreOffice.
- Pulsa Procesar y descarga `.txt` o `.rtf`.
- Revisa unos cuantos párrafos. Un escaneo sin capa de texto se verá vacío.
Límites y casos límite
- No es OCR; de un escaneo casi no sale texto
- No hay control de intervalo de páginas
- TXT no reconstruye el orden visual de varias columnas
- Límite de subida en este sitio web: 500 MB por archivo, enviado por partes a partir de unos 95 MB. El cuerpo de una sola petición directa a la API está limitado a 100 MB.
Ejemplos
- Un informe anual seleccionable suele dar un .txt largo
- Un PDF de foto de pizarra suele dar un archivo vacío o minúsculo
Privacidad de esta herramienta
Los archivos se suben por HTTPS, se procesan en memoria o en un directorio temporal de corta duración en nuestros servidores, y se eliminan cuando el resultado está listo. No conservamos copias para consultarlas después, entrenar modelos ni crear perfiles publicitarios. Consulte la Política de privacidad para los plazos de retención y las cookies de AdSense.
Preguntas frecuentes
- ¿Por qué el archivo de texto está vacío?
- El PDF no tiene objetos de texto que el extractor pueda leer. Los escaneos necesitan OCR a Markdown. Ese Markdown no entra en esta herramienta.
- ¿El TXT es lo mismo que copiar desde el visor?
- Parecido, no idéntico. El orden sigue cómo está guardado el texto en el flujo de la página. Un maquetado a varias columnas puede no coincidir con el orden de lectura visual.
- ¿Cuándo elijo RTF?
- Solo si quieres que LibreOffice reconstruya el documento. TXT es extracción directa y no necesita soffice.
- ¿Conserva fuentes y maquetación?
- TXT es texto plano. RTF es una reconstrucción a ciegas, no un calco píxel a píxel.
Última actualización:
Llámalo desde el código
Cada herramienta del sitio es un endpoint REST. Para uso anónimo no hace falta cuenta ni clave de API. Sirve igual para el navegador, para desarrolladores y para agentes de IA.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
-F "[email protected]" \
-F "outputFormat=txt" \
-o output.pdfTambién está disponible como herramienta MCP para clientes de agentes que hablan Model Context Protocol (JSON-RPC 2.0 por POST /mcp). Referencia completa de la API
Úsalo desde un agente de IA
SkillCon esta skill, Claude Code, Codex, Cursor y otros agentes de IA pueden usar «PDF a RTF (texto)» por ti: /skills/pdf123-pdf-to-text.md
Los archivos se usan solo para este trabajo y se borran automáticamente después.