跳至主要內容
PPDF123

把 PDF 表格轉成 Excel

PDF 轉 Excel 在 PDF 文字裡找出對齊的表格列,把每張表寫進 .xlsx 活頁簿的各自工作表。它需要文字層,遇到散文或掃描頁不會有輸出。

把檔案拖到這裡,或點一下選擇

支援 PDF · 每個檔案上限 500.0 MB · 一次最多 20 個檔案

也可以按 Ctrl/Cmd+V 或從剪貼簿選單貼上檔案。

PDF 轉 Excel 執行 `pdftotext -layout`,尋找含有連續兩個或更多空白的列,把那些列寫入 `.xlsx` 活頁簿。每張偵測到的表成為名為 `Page N` 或 `Page N Table M` 的工作表。適合欄位在抽出文字裡已經對齊的電子版 PDF。

一張表至少要有連續兩列像表格。散文、單獨一列表頭,或沒有文字層的掃描檔,會得到 `no_content`:沒有活頁簿。空結果是有意的,不是靜默失敗。

本工具忽略請求參數。本頁沒有頁範圍欄位。欄依連續兩個或更多空白切開;儲存格內的單個空白留在儲存格裡。

這不是 OCR。純影像掃描檔沒有可供 `pdftotext` 讀取的內容。本站 OCR 回傳 Markdown,不能再送進 PDF 轉 Excel。字只存在於像素時,這裡給不出試算表。

PDF 轉 CSV 用同一套版面啟發式。一張表變成一份 CSV;多張表變成 CSV 的 ZIP。Excel 把那些表放在同一活頁簿的各工作表裡。兩者都不會從 PDF 還原合併儲存格、彩色表頭或隱藏工作表。

用 Excel 或 LibreOffice Calc 打開下載,抽幾列核對欄切分。沒有雙空白間隙的緊表常常落進一欄。有密碼保護的檔案,在你輸入密碼後會在本頁為你解鎖;API 呼叫端需先執行移除密碼。

雙空白規則就是整個偵測機制,所以活頁簿品質完全取決於 PDF 的排版方式。報表產生器把每個儲存格補到固定寬度的表格,能乾淨地抽出。欄與欄之間只有一個空白、或使用比例字型讓欄位幾乎緊貼的表格,根本不會被當成表格,可能不傳回任何活頁簿。責怪工具之前,請先在 PDF 選取一列,確認文字本身可以選取。

工作表命名依位置,不依內容。每個偵測到的區塊會依掃描頁面的順序成為 `Page N` 或 `Page N Table M`。每頁一張表的報告,每頁會得到一張工作表;一頁疊了三張表,就會得到三張編號工作表。沒有依標題儲存格命名工作表的選項,也沒有合併成單一工作表的輸出。

所有值都以文字寫入,和保留版面的擷取結果完全一致。數字不會轉成數值儲存格,所以前置零得以保留,貨幣符號與千分位分隔符仍留在字串裡。對帳號和郵遞區號來說通常正合需要,對你想加總的金額欄則有點麻煩。請在試算表中轉換類型,或複製該欄,改用目標程式的分欄或數值轉換功能。

列不會去重,重複的表頭也不會刪除。表格跨頁斷開時,表頭列常在下一頁重複,續接部分自成另一張工作表。合併儲存格不會重建;在 PDF 中跨兩欄的儲存格,文字只落在最左欄,右欄留空。多列儲存格會變成多個列,而不是一個自動換行的值。

上傳是暫時的。我們不會保存你的活頁簿文庫。

功能

  • `pdftotext -layout` 加上雙空白分欄啟發式
  • 每張偵測到的表一張工作表;偵測為空則不回傳檔案
  • 不是 OCR;OCR 的 Markdown 不能送到這裡
  • 文字型儲存格;不做類型推斷,也不重建合併儲存格
  • 匿名 API:/api/v1/convert/pdf/xlsx

適用情境

  • 把抽出的表直接在 Excel 或 LibreOffice Calc 裡打開
  • 把電子版發票表拉進活頁簿
  • 讓多頁上的表各成工作表,而不是一份 CSV
  • 抽出固定寬度財務報表,供進一步分析

如何把 PDF 表格轉成 Excel?

  1. 上傳已有可選取文字、且呈表格式分欄的 PDF。
  2. 點選處理。本工具沒有頁範圍或 OCR 選項。
  3. 若找到表,下載 `.xlsx`。若沒有,你會得到空成功;請換帶文字層的來源檔。
  4. 打開活頁簿核對切分。純散文 PDF 不會產生工作表。

限制與邊界

  • 需要可選取文字,以及雙空白欄間隙
  • 沒有 OCR,也沒有頁範圍控制項
  • 不還原合併儲存格與樣式
  • 所有值都是文字,沒有數字或日期類型
  • 跨頁的表格會拆成多張工作表
  • 本網站的上傳上限:每個檔案 500 MB,超過約 95 MB 時分塊上傳。直接呼叫 API 時,單一請求本文上限為 100 MB。

示例

  • 帶三欄價目表的文字 PDF,常常變成那些欄的一張工作表
  • 沒有文字層的掃描銀行對帳單,不會回傳活頁簿
  • 一份十頁報告每頁一張表,會得到十張名為 Page 1 到 Page 10 的工作表

本工具的隱私說明

檔案經 HTTPS 上傳,在伺服器記憶體或短期暫存目錄中處理,結果就緒後即刪除。我們不會為日後瀏覽、訓練或廣告輪廓保留副本。留存期限與 AdSense Cookie 說明見隱私權政策。

常見問題

為什麼沒有試算表?
沒有找到連續兩列或更多的表格列。掃描檔、散文,以及沒有雙空白間隙的表,都會讓這套啟發式失敗。
可以先 OCR 再轉 Excel 嗎?
不可以。OCR 回傳 Markdown。本工具只透過 pdftotext 讀 PDF。
和 PDF 轉 CSV 有什麼不同?
偵測相同。Excel 把每張表寫進同一活頁簿的各自工作表。CSV 每張表一份檔(一張就是一份 CSV,多張則打成 ZIP)。
會讀每一頁嗎?
會。pdftotext 依換頁符號分頁。每一頁都掃描表塊。沒有頁範圍參數。
為什麼數字被存成文字?
值按擷取原樣寫入,所以前置零和格式得以保留。若要用它計算,請在試算表裡把該欄轉為數值。
合併儲存格會重建嗎?
不會。合併儲存格的文字落在最左欄,其餘欄為空。多列儲存格會變成多個列,而不是一個自動換行的值。
為什麼一張表會有多張工作表?
跨到新頁的表格會在那一頁被再次偵測,成為另一張工作表。表頭列常常重複,本工具不會合併這些片段。

最後更新:

用程式碼呼叫

本站每個工具都是普通 REST 介面。匿名使用不需要帳號或 API Key,給瀏覽器、開發者與 AI 代理同樣可用。

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

也提供 MCP 工具,供說 Model Context Protocol 的用戶端呼叫(JSON-RPC 2.0,POST /mcp)。 完整 API 文件

在 AI 代理中使用

Skill

裝上這個 Skill,Claude Code、Codex、Cursor 等 AI 代理就能替你完成「PDF 轉 Excel」: /skills/pdf123-pdf-to-xlsx.md

全部 Agent Skill

檔案只用於本次處理,完成後自動刪除。