แปลง PDF เป็นข้อความ
PDF เป็นข้อความ คือเครื่องมือที่ดึงข้อความที่มีอยู่แล้วใน PDF แล้วส่งกลับเป็นไฟล์ .txt ธรรมดาหรือ RTF ไม่รัน OCR ไฟล์สแกนที่เป็นภาพล้วนจึงออกมาว่าง
ลากไฟล์มาที่นี่ หรือคลิกเพื่อเลือก
รองรับ PDF · ไม่เกิน 500.0 MB ต่อไฟล์ · สูงสุด 20 ไฟล์ต่อครั้ง
คุณวางไฟล์ด้วย Ctrl/Cmd+V หรือจากเมนูคลิปบอร์ดได้เช่นกัน
การแปลง PDF เป็นข้อความดึงคำที่มีอยู่แล้วเป็นอ็อบเจ็กต์ข้อความ ค่าเริ่มต้นเส้นทาง `txt` ใช้ตัวดึงข้อความท้องถิ่นเดียวกับปฏิบัติการ pdf-core อื่น (`pdfio::extract_text`) คืน `text/plain` ไม่รัน OCR และไม่เรียก LibreOffice
เมื่อเลือก `rtf` ไฟล์ไป LibreOffice `writer_pdf_import` แทน เส้นทางนั้นต้องการ `soffice` บนเซิร์ฟเวอร์ และสร้างไฟล์ `.rtf` ริชเท็กซ์หยาบ การแทนแบบอักษรและตารางเพี้ยนเป็นเรื่องปกติ ถือว่า RTF เป็นร่าง
สแกนภาพล้วนได้ `.txt` ว่างหรือเกือบว่าง OCR บนเว็บนี้คืน Markdown ไม่ใช่ PDF ค้นหาได้ที่ส่งกลับมาที่นี่
หน้านี้ไม่มีฟิลด์ช่วงหน้า อ่านทุกหน้า ไฟล์ที่มีรหัสผ่านจะถูกปลดล็อกให้ในหน้านี้เมื่อคุณใส่รหัสผ่าน ส่วนผู้เรียก API ให้รันถอดรหัสผ่านก่อน
ถ้าต้องการหัวเรื่องและรายการแทนข้อความล้วน ใช้ PDF เป็น Markdown ถ้าต้องการตารางเป็นแถว ใช้ PDF เป็น CSV หรือ PDF เป็น Excel
ความสามารถ
- TXT ค่าเริ่มต้นใช้ตัวดึงข้อความท้องถิ่น ไม่ใช่ pdftotext และไม่ใช่ OCR
- เลือก RTF ได้ ผ่าน LibreOffice `writer_pdf_import`
- อ่านทุกหน้า ไม่มีพารามิเตอร์ช่วงหน้า
- API แบบไม่ระบุตัวตน: /api/v1/convert/pdf/text
ใช้เมื่อไหร่
- ดึงข้อความล้วนไปค้นหาหรือวาง
- ได้ร่าง RTF สำหรับแก้ต่อ
- อย่าใช้กับสแกนภาพล้วน
ดึงข้อความจากไฟล์ PDF ได้อย่างไร
- อัปโหลด PDF ที่มีข้อความเลือกได้
- คง TXT หรือเลือก RTF
- คลิกเริ่มประมวลผล แล้วดาวน์โหลด `.txt` หรือ `.rtf`
- เปิดไฟล์ตรวจลำดับย่อหน้า
ข้อจำกัดและกรณีพิเศษ
- ไม่ใช่ OCR สแกนแทบดึงคำไม่ได้
- ไม่มีตัวควบคุมช่วงหน้า
- TXT ไม่สร้างลำดับอ่านหลายคอลัมน์ตามสายตา
- ขีดจำกัดการอัปโหลดบนเว็บไซต์นี้: ไฟล์ละ 500 MB โดยไฟล์ที่ใหญ่กว่าประมาณ 95 MB จะถูกส่งเป็นส่วน ๆ ส่วนเนื้อหาของคำขอ API โดยตรงหนึ่งครั้งจำกัดที่ 100 MB
ตัวอย่าง
- บันทึกข้อความได้ไฟล์ .txt อ่านต่อเนื่อง
- สแกนไม่มีชั้นข้อความได้ไฟล์ว่างหรือเกือบว่าง
ความเป็นส่วนตัวของเครื่องมือนี้
ไฟล์อัปโหลดผ่าน HTTPS ประมวลผลในหน่วยความจำหรือไดเรกทอรีชั่วคราวอายุสั้นบนเซิร์ฟเวอร์ของเรา และลบเมื่อผลลัพธ์พร้อม เราไม่เก็บสำเนาไว้เปิดดูภายหลัง ฝึกโมเดล หรือสร้างโปรไฟล์โฆษณา รายละเอียดการเก็บรักษาและการเปิดเผยคุกกี้ AdSense อยู่ในนโยบายความเป็นส่วนตัว
คำถามที่พบบ่อย
- สแกนได้ข้อความไหม
- ว่างหรือเกือบว่างถ้าไม่มีชั้นข้อความ ใช้ OCR เป็น Markdown
- ต่างจาก PDF เป็น Markdown อย่างไร
- Markdown พยายามโครงหัวเรื่อง/รายการ ที่นี่เน้นข้อความล้วนหรือ RTF หยาบ
- RTF ใช้ LibreOffice หรือไม่
- ใช่ เส้นทาง rtf ใช้ writer_pdf_import ต้องการ soffice
- ต้องใส่รหัสผ่านก่อนไหม
- เฉพาะไฟล์ที่มีรหัสผ่าน หน้านี้จะถามรหัสผ่านและปลดล็อกให้ ส่วนผู้เรียก API ให้รันถอดรหัสผ่านก่อน
อัปเดตล่าสุด:
เรียกจากโค้ด
เครื่องมือทุกตัวบนเว็บนี้เป็น REST endpoint ธรรมดา ไม่ต้องมีบัญชีหรือคีย์ API ก็เรียกได้ ใช้ได้ทั้งเบราว์เซอร์ นักพัฒนา และเอเจนต์
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/text" \
-F "[email protected]" \
-F "outputFormat=txt" \
-o output.pdfมีเป็นเครื่องมือ MCP สำหรับไคลเอนต์เอเจนต์ที่รองรับ Model Context Protocol (JSON-RPC 2.0 ผ่าน POST /mcp) เอกสาร API ฉบับเต็ม
ใช้งานผ่านเอเจนต์ AI
สกิลเมื่อติดตั้งสกิลนี้ Claude Code, Codex, Cursor และเอเจนต์ AI อื่น ๆ จะใช้ "PDF เป็นข้อความ" แทนคุณได้: /skills/pdf123-pdf-to-text.md
ไฟล์ใช้เฉพาะงานนี้ เสร็จแล้วลบอัตโนมัติ