メインコンテンツへスキップ
PPDF123

PDFの表をExcelに変換する

PDFからExcelは、PDFの文字から列がそろった表の行を見つけ、表ごとに .xlsx ブックの別々のシートへ書き込みます。文字層が必要で、散文やスキャンしたページからは何も返しません。

ファイルをここにドロップするか、クリックして選んでください

対応形式:PDF・1ファイル500.0 MBまで · 一度に最大20ファイル

Ctrl/Cmd+V またはクリップボードメニューからファイルを貼り付けることもできます。

PDFからExcel は `pdftotext -layout` を実行し、連続する 2 つ以上の空白を含む行を探し、それらの行を `.xlsx` ブックに書き込みます。検出された各表は `Page N` または `Page N Table M` という名前のシートになります。抽出テキストで列がすでに揃っている電子版 PDF 向けです。

1 つの表には連続する 2 行以上の表らしい行が必要です。散文、単独の見出し行、テキスト層のないスキャンは `no_content` になります。ブックは返りません。空結果は意図的であり、静かな失敗ではありません。

このツールはリクエストパラメータを無視します。このページにページ範囲フィールドはありません。列は連続する 2 つ以上の空白で切れます。セル内の単一スペースはセルに残ります。

OCR ではありません。純画像スキャンには `pdftotext` が読む内容がありません。本サイトの OCR は Markdown を返し、PDFからExcel に再投入できません。文字がピクセルにしかないとき、ここから表計算は得られません。

PDFからCSV は同じレイアウトヒューリスティックを使います。1 表は 1 つの CSV、複数表は CSV の ZIP になります。Excel はそれらの表を同一ブックの各シートに置きます。どちらも PDF から結合セル・色付き見出し・非表示シートを復元しません。

ダウンロードを Excel または LibreOffice Calc で開き、何行か抜きで列の切れ方を確認してください。二重空白の隙間がない密な表は、しばしば 1 列に落ちます。パスワード保護されたファイルは、このページでパスワードを入力すると自動で解除されます。API を使う場合は先にパスワード解除を実行してください。

アップロードは一時的です。ブックの書庫は保持しません。

機能

  • `pdftotext -layout` と二重空白による列分割ヒューリスティック
  • 検出された表ごとに 1 シート。検出が空ならファイルを返さない
  • OCR ではない。OCR の Markdown はここに送れない
  • 匿名 API:/api/v1/convert/pdf/xlsx

こんなときに使う

  • 抽出した表をそのまま Excel または LibreOffice Calc で開く
  • 電子版の請求表をブックに取り込む
  • 複数ページの表を 1 つの CSV ではなく各シートにする

PDFの表をExcelに変換するには?

  1. 選べる文字があり、表形式で列が並ぶ PDF をアップロードします。
  2. 処理をクリックします。このツールにページ範囲や OCR オプションはありません。
  3. 表が見つかれば `.xlsx` をダウンロードします。なければ空の成功です。テキスト層のあるソースに変えてください。
  4. ブックを開き切れ方を確認します。純散文の PDF はシートを生みません。

制限と注意点

  • 選べる文字と、二重空白の列隙間が必要
  • OCR もページ範囲操作もない
  • 結合セルとスタイルは復元しない
  • このサイトのアップロード上限は 1 ファイルあたり 500 MB で、約 95 MB を超えると分割して送信されます。API への直接リクエスト 1 回の本文は 100 MB までです。

例

  • 3 列の価格表がある文字 PDF は、多くの場合それらの列の 1 シートになる
  • テキスト層のないスキャンの銀行明細は、ブックを返さない

このツールのプライバシー

ファイルは HTTPS でアップロードされ、サーバーのメモリまたは短命の一時ディレクトリで処理され、結果の準備ができた時点で削除されます。後から閲覧・学習・広告プロファイル用にコピーは残しません。保持期間と AdSense Cookie の開示はプライバシーポリシーをご覧ください。

よくある質問

なぜ表計算が出ないのですか?
連続する 2 行以上の表行が見つかりませんでした。スキャン、散文、二重空白の隙間がない表は、このヒューリスティックに失敗します。
先に OCR してから Excel にできますか?
できません。OCR は Markdown を返します。このツールは pdftotext 経由でのみ PDF を読みます。
PDFからCSV との違いは?
検出は同じです。Excel は各表を同一ブックの各シートに書きます。CSV は表ごとに 1 ファイル(1 表なら 1 CSV、複数なら ZIP)です。
すべてのページを読みますか?
読みます。pdftotext は改ページで分けます。各ページで表ブロックを走査します。ページ範囲パラメータはありません。

最終更新:

コードから呼び出す

このサイトの各ツールは、通常のRESTエンドポイントです。匿名利用にアカウントやAPIキーは不要です。ブラウザだけでなく、AIエージェントや開発者向けにも使えます。

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Model Context Protocolに対応したエージェント向けに、MCPツールとしても使えます(JSON-RPC 2.0、POST /mcp)。 APIリファレンス

AI エージェントから使う

スキル

このスキルを入れると、Claude Code、Codex、Cursor などの AI エージェントが「PDFからExcel」を代わりに実行できます: /skills/pdf123-pdf-to-xlsx.md

すべてのエージェント用スキル

ファイルはこの処理のためだけに使い、完了後に自動で削除します。