Aller au contenu principal
PPDF123

Convertir un PDF en texte

PDF vers RTF (texte) extrait le texte qui existe déjà dans un PDF et le renvoie en fichier .txt brut, ou en RTF. Il ne lance pas d’OCR : les scans composés uniquement d’images sortent vides.

Déposez des fichiers ici, ou cliquez pour les choisir

Formats acceptés : PDF · jusqu'à 500.0 MB par fichier · jusqu'à 20 fichiers à la fois

Vous pouvez aussi coller un fichier avec Ctrl/Cmd+V ou depuis le menu du presse-papiers.

PDF vers RTF (texte) extrait les mots déjà présents comme objets texte. Le chemin `txt` par défaut utilise le même extracteur local que les autres opérations pdf-core (`pdfio::extract_text`) et renvoie du `text/plain`. Pas d'OCR, pas d'appel à LibreOffice.

Avec `rtf`, le fichier passe par LibreOffice `writer_pdf_import`. Ce chemin exige `soffice` sur le serveur et reconstruit un rich text approximatif. Substitutions de polices et décalages de tableaux sont courants. Traitez le RTF comme un brouillon.

Un scan purement image donne un `.txt` vide ou quasi vide. L'OCR de ce site renvoie du Markdown, pas un PDF consultable à renvoyer ici.

Cette page n'a pas de champ de plage de pages. Chaque page est lue. Les fichiers protégés par mot de passe sont déverrouillés pour vous sur cette page une fois le mot de passe saisi ; via l'API, passez d'abord par Retirer le mot de passe.

Pour des titres et des listes plutôt que du texte brut, utilisez PDF vers Markdown. Pour des tableaux en lignes, utilisez PDF vers CSV ou PDF vers Excel.

L'envoi est temporaire. Nous ne conservons pas votre bibliothèque de textes.

Fonctions

  • TXT par défaut via extraction locale, ni pdftotext ni OCR
  • RTF optionnel via LibreOffice `writer_pdf_import`
  • Lit chaque page ; pas de paramètre de plage de pages
  • API anonyme : /api/v1/convert/pdf/text

Quand utiliser cet outil

  • Verser un rapport à couche de texte dans grep ou un script
  • Obtenir un brouillon RTF approximatif depuis un mémo électronique
  • Vérifier si un PDF a vraiment une couche de texte

Comment extraire le texte d’un PDF ?

  1. Téléversez un PDF qui a déjà du texte sélectionnable.
  2. Gardez TXT, ou choisissez RTF si vous voulez un brouillon rich text LibreOffice.
  3. Cliquez sur Traiter et téléchargez le `.txt` ou le `.rtf`.
  4. Vérifiez quelques passages. Les scans sans couche de texte paraîtront vides.

Limites et cas limites

  • Pas d'OCR ; les scans n'extraient presque rien
  • Pas de contrôle de plage de pages
  • TXT ne reconstruit pas l'ordre de lecture visuelle multi-colonnes
  • Limite d’envoi sur ce site : 500 Mo par fichier, envoyé par morceaux au-delà d’environ 95 Mo. Le corps d’une requête API directe est limité à 100 Mo.

Exemples

  • Un rapport annuel sélectionnable donne en général un long .txt
  • Un PDF photo de tableau blanc donne en général un fichier vide ou minuscule

Confidentialité de cet outil

Les fichiers sont envoyés en HTTPS, traités en mémoire ou dans un répertoire temporaire de courte durée sur nos serveurs, puis supprimés dès que le résultat est prêt. Nous ne conservons pas de copies pour une consultation ultérieure, un entraînement de modèles ou des profils publicitaires. Consultez la politique de confidentialité pour la durée de conservation et les cookies AdSense.

Questions fréquentes

Pourquoi le fichier texte est-il vide ?
Le PDF n'a pas d'objets texte que l'extracteur puisse lire. Les scans ont besoin d'OCR vers Markdown. Ce Markdown ne peut pas être renvoyé dans cet outil.
Le TXT est-il identique à un copier-coller depuis le lecteur ?
Proche, mais pas identique. L'ordre suit la façon dont le texte est stocké dans le flux de contenu. Une mise en page multi-colonnes peut différer de l'ordre de lecture visuelle.
Quand choisir RTF ?
Seulement si vous voulez que LibreOffice reconstruise le document. TXT est une extraction directe, sans soffice.
Polices et mise en page sont-elles conservées ?
TXT est du texte brut. RTF est une reconstruction sans garantie de fidélité, pas une correspondance pixel à pixel.

Dernière mise à jour:

Appeler depuis le code

Chaque outil du site est un endpoint REST. L'usage anonyme n'exige ni compte ni clé API. Pour le navigateur, les développeurs et les agents IA.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
  -F "[email protected]" \
  -F "outputFormat=txt" \
  -o output.pdf

Aussi disponible comme outil MCP pour les clients agents qui parlent le Model Context Protocol (JSON-RPC 2.0 via POST /mcp). Référence API complète

L'utiliser depuis un agent IA

Skill

Avec ce skill, Claude Code, Codex, Cursor et d'autres agents IA peuvent exécuter « PDF vers RTF (texte) » pour vous : /skills/pdf123-pdf-to-text.md

Tous les skills pour agents

Les fichiers ne servent qu'à ce traitement, puis sont supprimés automatiquement.