Konvertera PDF till text
PDF till RTF extraherar texten som redan finns i en PDF och returnerar den som en vanlig .txt-fil, eller som RTF. Den kör ingen OCR, så rena bildskanningar blir tomma.
Dra filer hit, eller klicka för att välja
Tar emot PDF · upp till 500.0 MB per fil · upp till 20 filer åt gången
Du kan också klistra in en fil med Ctrl/Cmd+V eller via urklippsmenyn.
PDF till RTF drar ut ord som redan finns som textobjekt. Standardvägen `txt` använder samma lokala extraherare som andra pdf-core-operationer (`pdfio::extract_text`) och returnerar `text/plain`. Ingen OCR och ingen LibreOffice.
Väljer du `rtf` går filen via LibreOffice `writer_pdf_import`. Den vägen kräver `soffice` på servern och bygger grov rich text. Typsnittsbyten och tabellfel är normalt. Behandla RTF som utkast.
Rena bildskanningar ger tom eller nästan tom `.txt`. Webbplatsens OCR returnerar Markdown, inte en sökbar PDF som kan skickas tillbaka hit.
Sidan har inget sidintervallfält. Varje sida läses. Lösenordsskyddade filer låses upp åt dig på den här sidan när du anger lösenordet; API-anropare kör Ta bort lösenord först.
Vill du ha rubriker och listor i stället för ren text, använd PDF till Markdown. Vill du ha tabeller som rader, använd PDF till CSV eller PDF till Excel.
Uppladdningar är tillfälliga. Vi sparar ingen textkatalog.
Funktioner
- Standard TXT via lokal textutvinning, varken pdftotext eller OCR
- Valfri RTF via LibreOffice `writer_pdf_import`
- Läser varje sida; ingen sidintervallparameter
- Anonym API: /api/v1/convert/pdf/text
När du ska använda det här verktyget
- Tömma textlager-rapporter till grep eller skript
- Få grovt RTF-utkast från digital promemoria
- Kontrollera om en PDF över huvud taget har textlager
Hur extraherar jag text ur en PDF?
- Ladda upp en PDF med markerbar text.
- Behåll TXT, eller välj RTF när du vill ha LibreOffice rich text-utkast.
- Klicka på Bearbeta och ladda ner `.txt` eller `.rtf`.
- Stickprovsgranska stycken. Skanningar utan textlager ser tomma ut.
Gränser och specialfall
- Ingen OCR; skanningar ger nästan ingen text
- Ingen sidintervallkontroll
- TXT återställer inte flerspalts visuell läsordning
- Uppladdningsgräns på webbplatsen: 500 MB per fil, som skickas i delar över cirka 95 MB. Innehållet i en enskild direkt API-förfrågan är begränsat till 100 MB.
Exempel
- En markerbar årsrapport ger ofta en lång .txt
- Whiteboardfoto-PDF ger vanligen blank eller mycket liten fil
Integritet för det här verktyget
Filer laddas upp via HTTPS, bearbetas i serverns minne eller en kortlivad tillfällig katalog och raderas när resultatet är klart. Vi behåller inga kopior för senare bläddring, träning eller annonsprofiler. Se integritetspolicyn för lagringstider och AdSense-cookieupplysningar.
Vanliga frågor
- Varför är textfilen tom?
- PDF:en hade inga textobjekt för extraheraren. Skanningar behöver OCR till Markdown. Den Markdown:en kan inte skickas hit igen.
- Är TXT samma som kopiera från läsaren?
- Nära, men inte identiskt. Ordningen följer hur text ligger i sidans innehållsström. Flerspalt kan skilja från visuell läsordning.
- När ska jag välja RTF?
- Bara när du vill att LibreOffice ska bygga om dokumentet. TXT är direktutdrag utan soffice.
- Behålls typsnitt och layout?
- TXT är ren text. RTF är återbyggnad så gott det går, inte pixelexakt.
Senast uppdaterad:
Anropa från kod
Varje verktyg på webbplatsen är ett vanligt REST-anrop. För anonym användning behövs varken konto eller API-nyckel. Lika mycket för AI-agenter och utvecklare som för webbläsaren.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
-F "[email protected]" \
-F "outputFormat=txt" \
-o output.pdfFinns också som MCP-verktyg för klienter som talar Model Context Protocol (JSON-RPC 2.0 via POST /mcp). Fullständig API-referens
Använd den från en AI-agent
SkillMed den här skillen kan Claude Code, Codex, Cursor och andra AI-agenter köra ”PDF till RTF” åt dig: /skills/pdf123-pdf-to-text.md
Filerna används bara för den här körningen och raderas automatiskt efteråt.