ข้ามไปยังเนื้อหาหลัก
PPDF123

แปลงตาราง PDF เป็น Excel

PDF เป็น Excel คือเครื่องมือที่หาแถวตารางที่เรียงตรงกันในข้อความของ PDF แล้วเขียนแต่ละตารางลงชีตของตัวเองในไฟล์ .xlsx ต้องมีชั้นข้อความ และจะไม่ได้อะไรจากร้อยแก้วหรือหน้าสแกน

ลากไฟล์มาที่นี่ หรือคลิกเพื่อเลือก

รองรับ PDF · ไม่เกิน 500.0 MB ต่อไฟล์ · สูงสุด 20 ไฟล์ต่อครั้ง

คุณวางไฟล์ด้วย Ctrl/Cmd+V หรือจากเมนูคลิปบอร์ดได้เช่นกัน

การแปลง PDF เป็น Excel รัน `pdftotext -layout` หาแถวที่มีช่องว่างติดกันสองตัวขึ้นไป แล้วเขียนแถวเหล่านั้นลงสมุดงาน `.xlsx` แต่ละตารางที่พบกลายเป็นแผ่นงานชื่อ `Page N` หรือ `Page N Table M` เหมาะกับ PDF อิเล็กทรอนิกส์ที่คอลัมน์จัดแนวในข้อความที่ดึงแล้ว

ตารางหนึ่งต้องมีอย่างน้อยสองแถวตารางติดกัน ร้อยแก้ว หัวตารางแถวเดียว หรือสแกนที่ไม่มีชั้นข้อความ ได้ `no_content` ไม่มีสมุดงาน ผลว่างตั้งใจ ไม่ใช่ความล้มเหลวเงียบ

เครื่องมือนี้ละเว้นพารามิเตอร์คำขอ หน้านี้ไม่มีฟิลด์ช่วงหน้า คอลัมน์ตัดที่ช่องว่างติดกันสองตัวขึ้นไป ช่องว่างเดี่ยวในเซลล์ยังอยู่ในเซลล์

นี่ไม่ใช่ OCR สแกนภาพล้วนไม่มีอะไรให้ `pdftotext` อ่าน OCR บนเว็บนี้คืน Markdown ส่งเข้า PDF เป็น Excel ต่อไม่ได้ เมื่อข้อความอยู่แค่ในพิกเซล ที่นี่ไม่มีสเปรดชีต

PDF เป็น CSV ใช้ฮิวริสติกเลย์เอาต์ชุดเดียวกัน ตารางหนึ่งกลายเป็น CSV หนึ่งไฟล์ หลายตารางกลายเป็น ZIP ของ CSV Excel วางตารางเหล่านั้นเป็นแผ่นงานในสมุดงานเดียวกัน ทั้งคู่ไม่คืนเซลล์รวม หัวสี หรือแผ่นงานซ่อนจาก PDF

เปิดไฟล์ดาวน์โหลดใน Excel หรือ LibreOffice Calc แล้วสุ่มตรวจการตัดคอลัมน์ ตารางแน่นที่ไม่มีช่องว่างคู่ มักตกในคอลัมน์เดียว ไฟล์ที่มีรหัสผ่านจะถูกปลดล็อกให้ในหน้านี้เมื่อคุณใส่รหัสผ่าน ส่วนผู้เรียก API ให้รันถอดรหัสผ่านก่อน

กฎช่องว่างคู่คือกลไกตรวจจับทั้งหมด คุณภาพของสมุดงานจึงขึ้นอยู่กับวิธีจัดเรียงตัวอักษรของ PDF ทั้งหมด ตารางจากตัวสร้างรายงานที่เติมช่องว่างให้แต่ละเซลล์จนได้ความกว้างคงที่ จะถูกดึงออกมาอย่างสะอาด ตารางที่ระหว่างคอลัมน์มีช่องว่างเดียว หรือใช้ฟอนต์แบบสัดส่วนที่วางคอลัมน์เกือบชิดกัน จะไม่ถูกนับเป็นตารางเลยและอาจไม่ให้สมุดงาน ก่อนโทษเครื่องมือ ให้เลือกหนึ่งแถวใน PDF แล้วยืนยันว่าข้อความนั้นเลือกได้จริง

ชื่อแผ่นงานอิงตำแหน่ง ไม่ใช่อิงเนื้อหา ทุกบล็อกที่ตรวจพบจะกลายเป็น `Page N` หรือ `Page N Table M` ตามลำดับการสแกนหน้า รายงานที่มีหนึ่งตารางต่อหน้าจะได้หนึ่งแผ่นงานต่อหน้า หน้าที่มีสามตารางเรียงกันจะได้สามแผ่นงานมีหมายเลข ไม่มีตัวเลือกตั้งชื่อแผ่นงานตามเซลล์หัวตาราง และไม่มีเอาต์พุตรวมเป็นแผ่นเดียว

ค่าถูกเขียนเป็นข้อความ ตามที่ปรากฏในการดึงที่รักษาเลย์เอาต์ไว้ ตัวเลขไม่ถูกแปลงเป็นเซลล์ตัวเลข เลขศูนย์นำหน้าจึงคงอยู่ และสัญลักษณ์สกุลเงินกับตัวคั่นหลักพันก็ยังอยู่ในสตริง ปกติเป็นสิ่งที่ต้องการสำหรับเลขบัญชีและรหัสไปรษณีย์ แต่ชวนรำคาญเล็กน้อยสำหรับคอลัมน์จำนวนเงินที่ตั้งใจจะรวมยอด จะแปลงชนิดในสเปรดชีต หรือคัดลอกคอลัมน์แล้วใช้แยกข้อความเป็นคอลัมน์หรือแปลงค่าของโปรแกรมปลายทาง

แถวไม่ถูกตัดรายการซ้ำ และหัวตารางที่ซ้ำก็ไม่ถูกลบ เมื่อตารางขาดตอนที่ขอบหน้า แถวหัวตารางมักซ้ำในหน้าถัดไปและส่วนต่อเนื่องกลายเป็นแผ่นงานของตัวเอง เซลล์ที่ผสานจะไม่ถูกสร้างใหม่ เซลล์ที่คร่อมสองคอลัมน์ใน PDF เพียงมีข้อความอยู่ในคอลัมน์ซ้ายสุดและคอลัมน์ขวาว่างเปล่า เซลล์หลายบรรทัดกลายเป็นแถวแยกกัน ไม่ใช่ค่าเดียวที่ตัดบรรทัด

การอัปโหลดชั่วคราว เราไม่เก็บคลังสมุดงานของคุณ

ความสามารถ

  • `pdftotext -layout` บวกฮิวริสติกตัดคอลัมน์ด้วยช่องว่างคู่
  • แผ่นงานหนึ่งต่อตารางที่พบ ว่างแล้วไม่คืนไฟล์
  • ไม่ใช่ OCR Markdown จาก OCR ส่งมาที่นี่ไม่ได้
  • เซลล์ชนิดข้อความ ไม่มีการอนุมานชนิดหรือสร้างเซลล์ผสานใหม่
  • API แบบไม่ระบุตัวตน: /api/v1/convert/pdf/xlsx

ใช้เมื่อไหร่

  • เปิดตารางที่ดึงแล้วใน Excel หรือ LibreOffice Calc โดยตรง
  • ดึงตารางใบแจ้งหนี้อิเล็กทรอนิกส์เข้าสมุดงาน
  • ให้ตารางหลายหน้าเป็นแผ่นงานแยก ไม่ใช่ CSV เดียว
  • ดึงงบการเงินความกว้างคงที่ไปวิเคราะห์ต่อ

แปลงตารางใน PDF เป็น Excel ได้อย่างไร

  1. อัปโหลด PDF ที่มีข้อความเลือกได้ และคอลัมน์จัดแบบตาราง
  2. คลิกเริ่มประมวลผล เครื่องมือนี้ไม่มีช่วงหน้าหรือตัวเลือก OCR
  3. ถ้าพบตาราง ดาวน์โหลด `.xlsx` ถ้าไม่พบ คุณได้ความสำเร็จว่าง ลองต้นทางที่มีชั้นข้อความ
  4. เปิดสมุดงานตรวจการตัด ร้อยแก้วล้วนจะไม่สร้างแผ่นงาน

ข้อจำกัดและกรณีพิเศษ

  • ต้องการข้อความเลือกได้ และช่องว่างคู่ระหว่างคอลัมน์
  • ไม่มี OCR และไม่มีตัวควบคุมช่วงหน้า
  • ไม่สร้างเซลล์ผสานและสไตล์ใหม่
  • ค่าทั้งหมดเป็นข้อความ ไม่มีการกำหนดชนิดตัวเลขหรือวันที่
  • ตารางที่คาบเกี่ยวหลายหน้ากลายเป็นแผ่นงานแยกกัน
  • ขีดจำกัดการอัปโหลดบนเว็บไซต์นี้: ไฟล์ละ 500 MB โดยไฟล์ที่ใหญ่กว่าประมาณ 95 MB จะถูกส่งเป็นส่วน ๆ ส่วนเนื้อหาของคำขอ API โดยตรงหนึ่งครั้งจำกัดที่ 100 MB

ตัวอย่าง

  • PDF ข้อความที่มีรายการราคาสามคอลัมน์มักกลายเป็นแผ่นงานของคอลัมน์เหล่านั้น
  • ใบแจ้งยอดธนาคารสแกนที่ไม่มีชั้นข้อความ จะไม่คืนสมุดงาน
  • รายงานสิบหน้าที่มีหนึ่งตารางต่อหน้าให้สิบแผ่นงานชื่อ Page 1 ถึง Page 10

ความเป็นส่วนตัวของเครื่องมือนี้

ไฟล์อัปโหลดผ่าน HTTPS ประมวลผลในหน่วยความจำหรือไดเรกทอรีชั่วคราวอายุสั้นบนเซิร์ฟเวอร์ของเรา และลบเมื่อผลลัพธ์พร้อม เราไม่เก็บสำเนาไว้เปิดดูภายหลัง ฝึกโมเดล หรือสร้างโปรไฟล์โฆษณา รายละเอียดการเก็บรักษาและการเปิดเผยคุกกี้ AdSense อยู่ในนโยบายความเป็นส่วนตัว

คำถามที่พบบ่อย

ทำไมฉันไม่ได้รับสเปรดชีต
ไม่พบบล็อกของแถวตารางติดกันสองแถวขึ้นไป สแกน ร้อยแก้ว และตารางที่ไม่มีช่องว่างคู่ ทำให้ฮิวริสติกล้มเหลว
ทำ OCR ก่อนแล้วแปลงเป็น Excel ได้ไหม
ไม่ได้ OCR คืน Markdown เครื่องมือนี้อ่าน PDF ผ่าน pdftotext เท่านั้น
ต่างจาก PDF เป็น CSV อย่างไร
การตรวจเหมือนกัน Excel เขียนแต่ละตารางเป็นแผ่นงานในสมุดงานเดียวกัน CSV เป็นหนึ่งไฟล์ต่อตาราง (หนึ่งตารางหนึ่ง CSV หลายตารางเป็น ZIP)
อ่านทุกหน้าหรือไม่
อ่าน pdftotext แบ่งหน้าตามตัวขึ้นหน้าใหม่ ทุกหน้าถูกสแกนหาบล็อกตาราง ไม่มีพารามิเตอร์ช่วงหน้า
ทำไมตัวเลขของฉันถูกเก็บเป็นข้อความ
ค่าถูกเขียนตามที่ดึงมา เลขศูนย์นำหน้าและการจัดรูปแบบจึงคงอยู่ หากต้องการคำนวณ ให้แปลงคอลัมน์เป็นตัวเลขในสเปรดชีต
เซลล์ที่ผสานถูกสร้างใหม่หรือไม่
ไม่ ข้อความของเซลล์ผสานไปอยู่ในคอลัมน์ซ้ายสุด และคอลัมน์อื่นว่างเปล่า เซลล์หลายบรรทัดกลายเป็นแถวแยกกัน ไม่ใช่ค่าเดียวที่ตัดบรรทัด
ทำไมตารางเดียวได้หลายแผ่นงาน
ตารางที่ต่อเนื่องไปหน้าใหม่จะถูกตรวจพบอีกครั้งที่นั่นและกลายเป็นอีกแผ่นงาน แถวหัวตารางมักซ้ำ เครื่องมือไม่รวมส่วนที่แยกกัน

อัปเดตล่าสุด:

เรียกจากโค้ด

เครื่องมือทุกตัวบนเว็บนี้เป็น REST endpoint ธรรมดา ไม่ต้องมีบัญชีหรือคีย์ API ก็เรียกได้ ใช้ได้ทั้งเบราว์เซอร์ นักพัฒนา และเอเจนต์

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

มีเป็นเครื่องมือ MCP สำหรับไคลเอนต์เอเจนต์ที่รองรับ Model Context Protocol (JSON-RPC 2.0 ผ่าน POST /mcp) เอกสาร API ฉบับเต็ม

ใช้งานผ่านเอเจนต์ AI

สกิล

เมื่อติดตั้งสกิลนี้ Claude Code, Codex, Cursor และเอเจนต์ AI อื่น ๆ จะใช้ "PDF เป็น Excel" แทนคุณได้: /skills/pdf123-pdf-to-xlsx.md

สกิลสำหรับเอเจนต์ทั้งหมด

ไฟล์ใช้เฉพาะงานนี้ เสร็จแล้วลบอัตโนมัติ