Ir para o conteúdo principal
PPDF123

Converter PDF em Texto

PDF para texto extrai o texto que já existe em um PDF e o devolve em um arquivo .txt simples ou em RTF. Não faz OCR, então digitalizações só de imagem saem vazias.

Arraste arquivos para cá, ou clique para escolher

Aceita PDF · até 500.0 MB por arquivo · até 20 arquivos por vez

Você também pode colar um arquivo com Ctrl/Cmd+V ou pelo menu da área de transferência.

PDF para RTF (texto) extrai as palavras que já existem como objetos de texto. O caminho padrão `txt` usa o extrator local dos outros operadores pdf-core (`pdfio::extract_text`) e devolve `text/plain`. Não roda OCR nem chama LibreOffice.

Com `rtf`, o arquivo segue pelo LibreOffice `writer_pdf_import`. Esse caminho precisa de `soffice` no servidor e reconstrói um rich text grosseiro. Substituição de fontes e tabelas desalinhadas são o normal. Trate o RTF como rascunho.

Digitalizações só-imagem geram `.txt` vazio ou quase vazio. O OCR do site devolve Markdown, não um PDF pesquisável que você possa mandar de volta para cá.

Nesta página não há campo de intervalo de páginas. Todas as páginas são lidas. Arquivos protegidos por senha são desbloqueados para você nesta página assim que você digita a senha; quem chama a API executa Remover senha antes.

Se quer títulos e listas em vez de texto puro, use PDF para Markdown. Se quer tabelas em linhas, use PDF para CSV ou PDF para Excel.

O envio é temporário. Não guardamos a sua biblioteca de texto.

Recursos

  • TXT padrão via extração local de texto; não é pdftotext nem OCR
  • RTF opcional via LibreOffice `writer_pdf_import`
  • Lê todas as páginas; sem parâmetro de intervalo
  • API anônima: /api/v1/convert/pdf/text

Quando usar esta ferramenta

  • Despejar relatório com camada de texto em grep ou scripts
  • Obter rascunho RTF grosseiro a partir de memorando eletrônico
  • Checar se um PDF realmente tem camada de texto

Como extrair o texto de um PDF?

  1. Envie um PDF que já tenha texto selecionável.
  2. Mantenha TXT, ou escolha RTF se quiser rascunho rich text do LibreOffice.
  3. Clique em Processar e baixe `.txt` ou `.rtf`.
  4. Confira alguns trechos. Digitalizações sem camada de texto parecem vazias.

Limites e casos-limite

  • Não é OCR; digitalizações quase não extraem palavras
  • Sem controle de intervalo de páginas
  • TXT não reconstrói a ordem visual de leitura em várias colunas
  • Limite de envio neste site: 500 MB por arquivo, enviado em partes acima de cerca de 95 MB. O corpo de uma única requisição direta à API é limitado a 100 MB.

Exemplos

  • Relatório anual selecionável costuma gerar um `.txt` longo
  • PDF de foto de quadro branco costuma gerar arquivo vazio ou minúsculo

Privacidade desta ferramenta

Os arquivos são enviados por HTTPS, processados em memória ou em um diretório temporário de curta duração nos nossos servidores, e apagados quando o resultado fica pronto. Não guardamos cópias para consulta posterior, treino de modelos ou perfis de publicidade. Consulte a Política de Privacidade para prazos de retenção e cookies do AdSense.

Perguntas frequentes

Por que o arquivo de texto está vazio?
O PDF não tem objetos de texto para o extrator ler. Digitalizações precisam de OCR para Markdown. Esse Markdown não entra de novo nesta ferramenta.
TXT é igual a copiar do visualizador?
Parecido, mas não idêntico. A ordem segue como o texto está nos fluxos de conteúdo. Layouts de várias colunas podem não bater com a ordem visual de leitura.
Quando escolher RTF?
Só quando você quer que o LibreOffice reconstrua o documento. TXT é extração direta, sem soffice.
Mantém fontes e layout?
TXT é texto puro. RTF é reconstrução no melhor esforço possível, não fidelidade pixel a pixel.

Última atualização:

Chame pelo código

Cada ferramenta deste site é um endpoint REST. Para uso anônimo não precisa de conta nem de chave de API. Serve para o navegador, para desenvolvedores e para agentes de IA.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
  -F "[email protected]" \
  -F "outputFormat=txt" \
  -o output.pdf

Também disponível como ferramenta MCP para clientes de agente que falam Model Context Protocol (JSON-RPC 2.0 via POST /mcp). Referência completa da API

Use a partir de um agente de IA

Skill

Com esta skill, Claude Code, Codex, Cursor e outros agentes de IA podem usar "PDF para RTF (texto)" para você: /skills/pdf123-pdf-to-text.md

Todas as skills para agentes

Os arquivos servem só para este processamento e são apagados automaticamente depois.