ข้ามไปยังเนื้อหาหลัก
PPDF123

ดึงตารางจาก PDF เป็น CSV

PDF เป็น CSV คือเครื่องมือที่หาแถวตารางที่เรียงตรงกันในข้อความของ PDF แล้วเขียนแต่ละตารางที่ตรวจพบเป็นไฟล์ CSV หลายตารางจะส่งใน ZIP ต้องมีชั้นข้อความ และจะไม่ได้อะไรจากร้อยแก้วหรือไฟล์สแกน

ลากไฟล์มาที่นี่ หรือคลิกเพื่อเลือก

รองรับ PDF · ไม่เกิน 500.0 MB ต่อไฟล์ · สูงสุด 20 ไฟล์ต่อครั้ง

คุณวางไฟล์ด้วย Ctrl/Cmd+V หรือจากเมนูคลิปบอร์ดได้เช่นกัน

การแปลง PDF เป็น CSV รัน `pdftotext -layout` หาแถวที่มีช่องว่างติดกันสองตัวขึ้นไป แล้วเขียนเป็น CSV แต่ละตารางที่พบเป็น `{base}_pN_tM.csv` เหมาะกับ PDF อิเล็กทรอนิกส์ที่คอลัมน์อยู่ในข้อความที่ดึงแล้ว

ตารางหนึ่งต้องมีอย่างน้อยสองแถวตารางติดกัน ร้อยแก้ว หัวตารางแถวเดียว หรือสแกนไม่มีชั้นข้อความ ได้ `no_content`: HTTP 204 และไม่มีไฟล์ ผลว่างตั้งใจ

ตัวแปลงละเว้นพารามิเตอร์คำขอ ฟิลด์ช่วงหน้าบนหน้านี้ไม่ถูกอ่าน สแกนทุกหน้า ตารางหนึ่งเป็น `text/csv` หลายตารางเป็น ZIP ชื่อ `{base}_extracted.zip` คอลัมน์ตัดที่ช่องว่างสองตัวขึ้นไป ค่าถูกใส่เครื่องหมายตาม RFC 4180

นี่ไม่ใช่ OCR สแกนภาพล้วนไม่มีอะไรให้ `pdftotext` อ่าน OCR บนเว็บนี้คืน Markdown ส่งกลับมาที่นี่ไม่ได้

PDF เป็น Excel ใช้ฮิวริสติกเลย์เอาต์ชุดเดียวกัน Excel วางตารางเป็นแผ่นงาน CSV เขียนหนึ่งไฟล์ต่อตาราง ทั้งคู่ไม่คืนเซลล์รวมหรือหัวสี

เปิดใน Excel หรือ LibreOffice Calc แล้วตรวจการตัดคอลัมน์ ไฟล์ที่มีรหัสผ่านจะถูกปลดล็อกให้ในหน้านี้เมื่อคุณใส่รหัสผ่าน ส่วนผู้เรียก API ให้รันถอดรหัสผ่านก่อน

ความสามารถ

  • `pdftotext -layout` บวกฮิวริสติกช่องว่างคู่
  • หนึ่ง CSV ต่อตาราง หลายตารางเป็น ZIP ว่างแล้ว HTTP 204
  • ไม่ใช่ OCR Markdown จาก OCR เข้าไม่ได้
  • API แบบไม่ระบุตัวตน: /api/v1/convert/pdf/csv

ใช้เมื่อไหร่

  • ดึงตารางใบแจ้งหนี้อิเล็กทรอนิกส์เข้า Excel หรือ LibreOffice Calc
  • เก็บตารางหลายหน้าเป็น CSV แยก
  • ส่งตารางที่จัดเลย์เอาต์แล้วให้สคริปต์ที่ต้องการ CSV

ดึงตารางจาก PDF เป็น CSV ได้อย่างไร

  1. อัปโหลด PDF ที่มีข้อความเลือกได้และคอลัมน์มองเห็นในข้อความที่ดึง
  2. คลิกเริ่มประมวลผล ฟิลด์ช่วงหน้าอยู่แต่ตัวแปลงไม่อ่าน ไม่มีตัวเลือก OCR
  3. ตารางหนึ่งได้ `.csv` หลายตารางได้ ZIP ไม่มีตารางได้ความสำเร็จว่าง
  4. เปิดไฟล์ตรวจการตัด ร้อยแก้วล้วนจะไม่มีไฟล์

ข้อจำกัดและกรณีพิเศษ

  • ต้องการข้อความเลือกได้และช่องว่างคู่
  • ไม่มี OCR และไม่มีช่วงหน้าที่ใช้ได้
  • ไม่คืนเซลล์รวมและการจัดรูปแบบ
  • ขีดจำกัดการอัปโหลดบนเว็บไซต์นี้: ไฟล์ละ 500 MB โดยไฟล์ที่ใหญ่กว่าประมาณ 95 MB จะถูกส่งเป็นส่วน ๆ ส่วนเนื้อหาของคำขอ API โดยตรงหนึ่งครั้งจำกัดที่ 100 MB

ตัวอย่าง

  • PDF ข้อความที่มีรายการราคาสามคอลัมน์มักได้ CSV เดียวของคอลัมน์เหล่านั้น
  • ใบแจ้งยอดสแกนไม่มีชั้นข้อความได้ HTTP 204

ความเป็นส่วนตัวของเครื่องมือนี้

ไฟล์อัปโหลดผ่าน HTTPS ประมวลผลในหน่วยความจำหรือไดเรกทอรีชั่วคราวอายุสั้นบนเซิร์ฟเวอร์ของเรา และลบเมื่อผลลัพธ์พร้อม เราไม่เก็บสำเนาไว้เปิดดูภายหลัง ฝึกโมเดล หรือสร้างโปรไฟล์โฆษณา รายละเอียดการเก็บรักษาและการเปิดเผยคุกกี้ AdSense อยู่ในนโยบายความเป็นส่วนตัว

คำถามที่พบบ่อย

ทำไมไม่มี CSV
ไม่พบบล็อกแถวตารางติดกันสองแถวขึ้นไป สแกน ร้อยแก้ว และตารางไม่มีช่องว่างคู่ ทำให้ฮิวริสติกล้มเหลว API ตอบ 204 `no_content`
ทำ OCR ก่อนแล้วแปลงเป็น CSV ได้ไหม
ไม่ได้ OCR คืน Markdown เครื่องมือนี้อ่าน PDF ผ่าน pdftotext เท่านั้น
รายการหน้าบนฟอร์มทำอะไร
ไม่มีผล ฟิลด์อยู่บนฟอร์มแต่ตัวแปลงไม่อ่าน สแกนทุกหน้า
หลายตารางรวมเป็น CSV เดียวไหม
ไม่ หนึ่งไฟล์ต่อตาราง หลายตารางอยู่ใน ZIP `{base}_extracted.zip`

อัปเดตล่าสุด:

เรียกจากโค้ด

เครื่องมือทุกตัวบนเว็บนี้เป็น REST endpoint ธรรมดา ไม่ต้องมีบัญชีหรือคีย์ API ก็เรียกได้ ใช้ได้ทั้งเบราว์เซอร์ นักพัฒนา และเอเจนต์

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/csv" \
  -F "[email protected]" \
  -F "pageNumbers=all" \
  -o output.pdf

มีเป็นเครื่องมือ MCP สำหรับไคลเอนต์เอเจนต์ที่รองรับ Model Context Protocol (JSON-RPC 2.0 ผ่าน POST /mcp) เอกสาร API ฉบับเต็ม

ใช้งานผ่านเอเจนต์ AI

สกิล

เมื่อติดตั้งสกิลนี้ Claude Code, Codex, Cursor และเอเจนต์ AI อื่น ๆ จะใช้ "PDF เป็น CSV" แทนคุณได้: /skills/pdf123-pdf-to-csv.md

สกิลสำหรับเอเจนต์ทั้งหมด

ไฟล์ใช้เฉพาะงานนี้ เสร็จแล้วลบอัตโนมัติ