ดึงตารางจาก PDF เป็น CSV
PDF เป็น CSV คือเครื่องมือที่หาแถวตารางที่เรียงตรงกันในข้อความของ PDF แล้วเขียนแต่ละตารางที่ตรวจพบเป็นไฟล์ CSV หลายตารางจะส่งใน ZIP ต้องมีชั้นข้อความ และจะไม่ได้อะไรจากร้อยแก้วหรือไฟล์สแกน
ลากไฟล์มาที่นี่ หรือคลิกเพื่อเลือก
รองรับ PDF · ไม่เกิน 500.0 MB ต่อไฟล์ · สูงสุด 20 ไฟล์ต่อครั้ง
คุณวางไฟล์ด้วย Ctrl/Cmd+V หรือจากเมนูคลิปบอร์ดได้เช่นกัน
การแปลง PDF เป็น CSV รัน `pdftotext -layout` หาแถวที่มีช่องว่างติดกันสองตัวขึ้นไป แล้วเขียนเป็น CSV แต่ละตารางที่พบเป็น `{base}_pN_tM.csv` เหมาะกับ PDF อิเล็กทรอนิกส์ที่คอลัมน์อยู่ในข้อความที่ดึงแล้ว
ตารางหนึ่งต้องมีอย่างน้อยสองแถวตารางติดกัน ร้อยแก้ว หัวตารางแถวเดียว หรือสแกนไม่มีชั้นข้อความ ได้ `no_content`: HTTP 204 และไม่มีไฟล์ ผลว่างตั้งใจ
ตัวแปลงละเว้นพารามิเตอร์คำขอ ฟิลด์ช่วงหน้าบนหน้านี้ไม่ถูกอ่าน สแกนทุกหน้า ตารางหนึ่งเป็น `text/csv` หลายตารางเป็น ZIP ชื่อ `{base}_extracted.zip` คอลัมน์ตัดที่ช่องว่างสองตัวขึ้นไป ค่าถูกใส่เครื่องหมายตาม RFC 4180
นี่ไม่ใช่ OCR สแกนภาพล้วนไม่มีอะไรให้ `pdftotext` อ่าน OCR บนเว็บนี้คืน Markdown ส่งกลับมาที่นี่ไม่ได้
PDF เป็น Excel ใช้ฮิวริสติกเลย์เอาต์ชุดเดียวกัน Excel วางตารางเป็นแผ่นงาน CSV เขียนหนึ่งไฟล์ต่อตาราง ทั้งคู่ไม่คืนเซลล์รวมหรือหัวสี
เปิดใน Excel หรือ LibreOffice Calc แล้วตรวจการตัดคอลัมน์ ไฟล์ที่มีรหัสผ่านจะถูกปลดล็อกให้ในหน้านี้เมื่อคุณใส่รหัสผ่าน ส่วนผู้เรียก API ให้รันถอดรหัสผ่านก่อน
ความสามารถ
- `pdftotext -layout` บวกฮิวริสติกช่องว่างคู่
- หนึ่ง CSV ต่อตาราง หลายตารางเป็น ZIP ว่างแล้ว HTTP 204
- ไม่ใช่ OCR Markdown จาก OCR เข้าไม่ได้
- API แบบไม่ระบุตัวตน: /api/v1/convert/pdf/csv
ใช้เมื่อไหร่
- ดึงตารางใบแจ้งหนี้อิเล็กทรอนิกส์เข้า Excel หรือ LibreOffice Calc
- เก็บตารางหลายหน้าเป็น CSV แยก
- ส่งตารางที่จัดเลย์เอาต์แล้วให้สคริปต์ที่ต้องการ CSV
ดึงตารางจาก PDF เป็น CSV ได้อย่างไร
- อัปโหลด PDF ที่มีข้อความเลือกได้และคอลัมน์มองเห็นในข้อความที่ดึง
- คลิกเริ่มประมวลผล ฟิลด์ช่วงหน้าอยู่แต่ตัวแปลงไม่อ่าน ไม่มีตัวเลือก OCR
- ตารางหนึ่งได้ `.csv` หลายตารางได้ ZIP ไม่มีตารางได้ความสำเร็จว่าง
- เปิดไฟล์ตรวจการตัด ร้อยแก้วล้วนจะไม่มีไฟล์
ข้อจำกัดและกรณีพิเศษ
- ต้องการข้อความเลือกได้และช่องว่างคู่
- ไม่มี OCR และไม่มีช่วงหน้าที่ใช้ได้
- ไม่คืนเซลล์รวมและการจัดรูปแบบ
- ขีดจำกัดการอัปโหลดบนเว็บไซต์นี้: ไฟล์ละ 500 MB โดยไฟล์ที่ใหญ่กว่าประมาณ 95 MB จะถูกส่งเป็นส่วน ๆ ส่วนเนื้อหาของคำขอ API โดยตรงหนึ่งครั้งจำกัดที่ 100 MB
ตัวอย่าง
- PDF ข้อความที่มีรายการราคาสามคอลัมน์มักได้ CSV เดียวของคอลัมน์เหล่านั้น
- ใบแจ้งยอดสแกนไม่มีชั้นข้อความได้ HTTP 204
ความเป็นส่วนตัวของเครื่องมือนี้
ไฟล์อัปโหลดผ่าน HTTPS ประมวลผลในหน่วยความจำหรือไดเรกทอรีชั่วคราวอายุสั้นบนเซิร์ฟเวอร์ของเรา และลบเมื่อผลลัพธ์พร้อม เราไม่เก็บสำเนาไว้เปิดดูภายหลัง ฝึกโมเดล หรือสร้างโปรไฟล์โฆษณา รายละเอียดการเก็บรักษาและการเปิดเผยคุกกี้ AdSense อยู่ในนโยบายความเป็นส่วนตัว
คำถามที่พบบ่อย
- ทำไมไม่มี CSV
- ไม่พบบล็อกแถวตารางติดกันสองแถวขึ้นไป สแกน ร้อยแก้ว และตารางไม่มีช่องว่างคู่ ทำให้ฮิวริสติกล้มเหลว API ตอบ 204 `no_content`
- ทำ OCR ก่อนแล้วแปลงเป็น CSV ได้ไหม
- ไม่ได้ OCR คืน Markdown เครื่องมือนี้อ่าน PDF ผ่าน pdftotext เท่านั้น
- รายการหน้าบนฟอร์มทำอะไร
- ไม่มีผล ฟิลด์อยู่บนฟอร์มแต่ตัวแปลงไม่อ่าน สแกนทุกหน้า
- หลายตารางรวมเป็น CSV เดียวไหม
- ไม่ หนึ่งไฟล์ต่อตาราง หลายตารางอยู่ใน ZIP `{base}_extracted.zip`
อัปเดตล่าสุด:
เรียกจากโค้ด
เครื่องมือทุกตัวบนเว็บนี้เป็น REST endpoint ธรรมดา ไม่ต้องมีบัญชีหรือคีย์ API ก็เรียกได้ ใช้ได้ทั้งเบราว์เซอร์ นักพัฒนา และเอเจนต์
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/csv" \
-F "[email protected]" \
-F "pageNumbers=all" \
-o output.pdfมีเป็นเครื่องมือ MCP สำหรับไคลเอนต์เอเจนต์ที่รองรับ Model Context Protocol (JSON-RPC 2.0 ผ่าน POST /mcp) เอกสาร API ฉบับเต็ม
ใช้งานผ่านเอเจนต์ AI
สกิลเมื่อติดตั้งสกิลนี้ Claude Code, Codex, Cursor และเอเจนต์ AI อื่น ๆ จะใช้ "PDF เป็น CSV" แทนคุณได้: /skills/pdf123-pdf-to-csv.md
ไฟล์ใช้เฉพาะงานนี้ เสร็จแล้วลบอัตโนมัติ