PDFをHTMLファイルにする
PDFからHTMLは、Popplerのpdftohtmlを使ってPDFを変換し、HTMLページと画像をまとめたZIPを渡します。整ったウェブ用マークアップではなくレイアウトの書き出しで、OCRは行いません。
ファイルをここにドロップするか、クリックして選んでください
対応形式:PDF・1ファイル500.0 MBまで · 一度に最大20ファイル
Ctrl/Cmd+V またはクリップボードメニューからファイルを貼り付けることもできます。
PDFからHTML は Poppler `pdftohtml -c` を実行し、そのツールが出力ディレクトリに書いた内容を ZIP にまとめます。ダウンロード名は `{base}ToHtml.zip` であり、単一の `.html` ではありません。目標はブラウザ級 CSS ではなく、Poppler の HTML と画像の書き出しです。
このページにフォーム欄はありません。すべてのページが変換されます。`pdftohtml` が何も書かなければ、空 ZIP ではなく内部エラーが返ります。
OCR ではありません。純画像スキャンは HTML パッケージ内の画像になり、選べる文字にはなりません。パスワード保護されたファイルは、このページでパスワードを入力すると自動で解除されます。API を使う場合は先にパスワード解除を実行してください。
文字だけでよいなら PDFからテキスト です。CMS 向けの記事なら PDFからMarkdown です。
アップロードは一時的です。HTML の書庫は保持しません。
機能
- Poppler `pdftohtml -c`。HTML とリソースの ZIP
- ページ範囲やテーマの選択肢なし
- OCR ではない。スキャンはパッケージ内でなお画像
- 匿名 API:/api/v1/convert/pdf/html
こんなときに使う
- テキスト層付き PDF から粗い HTML を得る
- pdftohtml が抽出したページ画像を持ち帰る
- 自前パイプラインの前に、Poppler がこのファイルをどう理解するか見る
PDFをHTMLに変換するには?
- PDF をアップロードします。このページに変換オプションはありません。
- 処理をクリックし、`{name}ToHtml.zip` をダウンロードします。
- 解凍してブラウザで HTML を開きます。
- 図と文字を確認します。スキャンは本当の HTML 文字にはなりません。
制限と注意点
- 出力は ZIP。単一 HTML ではない
- Chromium 印刷でも、タグ付き PDF の HTML 書き出しでもない
- pdftohtml の空出力はエラーであり、204 ではない
- このサイトのアップロード上限は 1 ファイルあたり 500 MB で、約 95 MB を超えると分割して送信されます。API への直接リクエスト 1 回の本文は 100 MB までです。
例
- 簡単な文字メモは、多くの場合 HTML 1 本と数枚の図に解凍される
- 純スキャン PDF の HTML は、そのページ画像を包むことが多い
このツールのプライバシー
ファイルは HTTPS でアップロードされ、サーバーのメモリまたは短命の一時ディレクトリで処理され、結果の準備ができた時点で削除されます。後から閲覧・学習・広告プロファイル用にコピーは残しません。保持期間と AdSense Cookie の開示はプライバシーポリシーをご覧ください。
よくある質問
- なぜ結果が ZIP なのですか?
- pdftohtml は HTML と抽出した図を 1 つのフォルダに書きます。サーバーがそのフォルダをまとめます。
- HTML は PDF の版式と一致しますか?
- Poppler `-c` モードの範囲までです。多段組の雑誌や大量のベクタはしばしば揃いません。
- スキャンを HTML 文字にできますか?
- できません。この経路は OCR しません。文字が必要なら OCR(Markdown)を使ってください。
- ブラウザ内で変換しますか?
- しません。サーバーが pdftohtml を呼び出します。
最終更新:
コードから呼び出す
このサイトの各ツールは、通常のRESTエンドポイントです。匿名利用にアカウントやAPIキーは不要です。ブラウザだけでなく、AIエージェントや開発者向けにも使えます。
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
-F "[email protected]" \
-o output.pdfModel Context Protocolに対応したエージェント向けに、MCPツールとしても使えます(JSON-RPC 2.0、POST /mcp)。 APIリファレンス
AI エージェントから使う
スキルこのスキルを入れると、Claude Code、Codex、Cursor などの AI エージェントが「PDFからHTML」を代わりに実行できます: /skills/pdf123-pdf-to-html.md
ファイルはこの処理のためだけに使い、完了後に自動で削除します。