メインコンテンツへスキップ
PPDF123

PDFをHTMLファイルにする

PDFからHTMLは、Popplerのpdftohtmlを使ってPDFを変換し、HTMLページと画像をまとめたZIPを渡します。整ったウェブ用マークアップではなくレイアウトの書き出しで、OCRは行いません。

ファイルをここにドロップするか、クリックして選んでください

対応形式:PDF・1ファイル500.0 MBまで · 一度に最大20ファイル

Ctrl/Cmd+V またはクリップボードメニューからファイルを貼り付けることもできます。

PDFからHTML は Poppler `pdftohtml -c` を実行し、そのツールが出力ディレクトリに書いた内容を ZIP にまとめます。ダウンロード名は `{base}ToHtml.zip` であり、単一の `.html` ではありません。目標はブラウザ級 CSS ではなく、Poppler の HTML と画像の書き出しです。

このページにフォーム欄はありません。すべてのページが変換されます。`pdftohtml` が何も書かなければ、空 ZIP ではなく内部エラーが返ります。

OCR ではありません。純画像スキャンは HTML パッケージ内の画像になり、選べる文字にはなりません。パスワード保護されたファイルは、このページでパスワードを入力すると自動で解除されます。API を使う場合は先にパスワード解除を実行してください。

文字だけでよいなら PDFからテキスト です。CMS 向けの記事なら PDFからMarkdown です。

アップロードは一時的です。HTML の書庫は保持しません。

機能

  • Poppler `pdftohtml -c`。HTML とリソースの ZIP
  • ページ範囲やテーマの選択肢なし
  • OCR ではない。スキャンはパッケージ内でなお画像
  • 匿名 API:/api/v1/convert/pdf/html

こんなときに使う

  • テキスト層付き PDF から粗い HTML を得る
  • pdftohtml が抽出したページ画像を持ち帰る
  • 自前パイプラインの前に、Poppler がこのファイルをどう理解するか見る

PDFをHTMLに変換するには?

  1. PDF をアップロードします。このページに変換オプションはありません。
  2. 処理をクリックし、`{name}ToHtml.zip` をダウンロードします。
  3. 解凍してブラウザで HTML を開きます。
  4. 図と文字を確認します。スキャンは本当の HTML 文字にはなりません。

制限と注意点

  • 出力は ZIP。単一 HTML ではない
  • Chromium 印刷でも、タグ付き PDF の HTML 書き出しでもない
  • pdftohtml の空出力はエラーであり、204 ではない
  • このサイトのアップロード上限は 1 ファイルあたり 500 MB で、約 95 MB を超えると分割して送信されます。API への直接リクエスト 1 回の本文は 100 MB までです。

例

  • 簡単な文字メモは、多くの場合 HTML 1 本と数枚の図に解凍される
  • 純スキャン PDF の HTML は、そのページ画像を包むことが多い

このツールのプライバシー

ファイルは HTTPS でアップロードされ、サーバーのメモリまたは短命の一時ディレクトリで処理され、結果の準備ができた時点で削除されます。後から閲覧・学習・広告プロファイル用にコピーは残しません。保持期間と AdSense Cookie の開示はプライバシーポリシーをご覧ください。

よくある質問

なぜ結果が ZIP なのですか?
pdftohtml は HTML と抽出した図を 1 つのフォルダに書きます。サーバーがそのフォルダをまとめます。
HTML は PDF の版式と一致しますか?
Poppler `-c` モードの範囲までです。多段組の雑誌や大量のベクタはしばしば揃いません。
スキャンを HTML 文字にできますか?
できません。この経路は OCR しません。文字が必要なら OCR(Markdown)を使ってください。
ブラウザ内で変換しますか?
しません。サーバーが pdftohtml を呼び出します。

最終更新:

コードから呼び出す

このサイトの各ツールは、通常のRESTエンドポイントです。匿名利用にアカウントやAPIキーは不要です。ブラウザだけでなく、AIエージェントや開発者向けにも使えます。

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Model Context Protocolに対応したエージェント向けに、MCPツールとしても使えます(JSON-RPC 2.0、POST /mcp)。 APIリファレンス

AI エージェントから使う

スキル

このスキルを入れると、Claude Code、Codex、Cursor などの AI エージェントが「PDFからHTML」を代わりに実行できます: /skills/pdf123-pdf-to-html.md

すべてのエージェント用スキル

ファイルはこの処理のためだけに使い、完了後に自動で削除します。