Nenda kwenye maudhui makuu
PPDF123

Geuza PDF kuwa HTML

PDF kuwa HTML hugeuza PDF kwa pdftohtml ya Poppler na kuwasilisha ZIP yenye kurasa za HTML na picha zake. Ni utupaji wa mpangilio badala ya alama safi za wavuti, na haifanyi OCR.

Buruta faili hapa, au bofya uchague

Inakubali PDF · hadi 500.0 MB kwa kila faili · hadi faili 20 kwa mara moja

Unaweza pia kubandika faili kwa Ctrl/Cmd+V au kutoka kwenye menyu ya ubao wa kunakili.

PDF kuwa HTML huendesha Poppler `pdftohtml -c` na kufungasha yaliyoandikwa kwenye folda ya pato kuwa ZIP. Jina la upakuaji ni `{base}ToHtml.zip`, si `.html` moja. Lengo si CSS ya kiwango cha kivinjari, bali mauzo ya Poppler.

Ukurasa huu hauna uga za fomu. Kila ukurasa unageuzwa. `pdftohtml` isipoandika chochote, API inarudisha hitilafu ya ndani, si ZIP tupu.

Si OCR. Skani za picha pekee zinakuwa picha ndani ya kifurushi cha HTML, si maandishi yanayochaguliwa. Faili zilizolindwa kwa nenosiri hufunguliwa kwa ajili yako kwenye ukurasa huu ukishaingiza nenosiri; wapigaji wa API waendeshe Ondoa nenosiri kwanza.

Unayetaka maandishi tu, tumia PDF kuwa RTF (maandishi). Unayetaka makala ya CMS, tumia PDF kuwa Markdown.

Sifa

  • Poppler pdftohtml -c → ZIP
  • Si OCR; skani zinakuwa picha
  • Si ugeuzi wa kivinjari
  • API isiyo na jina: /api/v1/convert/pdf/html

Lini utumie

  • Kupata HTML ghafi kutoka PDF ya maandishi
  • Kufungasha kurasa za Poppler kwa ukaguzi
  • Kabla ya Markdown ikiwa unahitaji HTML

Ninageuzaje PDF kuwa HTML?

  1. Pakia PDF.
  2. Bofya Chakata.
  3. Pakua ZIP ({base}ToHtml.zip).
  4. Fungua HTML ndani — usitarajie CSS kamili.

Mipaka na hali maalum

  • Si OCR
  • Pato ni ZIP
  • Faili zilizolindwa kwa nenosiri zinahitaji nenosiri; wapigaji wa API waendeshe Ondoa nenosiri kwanza
  • Kikomo cha kupakia kwenye tovuti hii: MB 500 kwa kila faili, likitumwa kwa vipande zaidi ya takriban MB 95. Mwili wa ombi moja la moja la API una kikomo cha MB 100.

Mifano

  • PDF ya maandishi inatoa ZIP yenye HTML/picha
  • Skani inatoa picha katika HTML, si maandishi

Faragha ya zana hii

Faili hupakiwa kupitia HTTPS, zinachakatwa kwenye kumbukumbu au folda ya muda mfupi kwenye seva zetu, na kufutwa matokeo yakiwa tayari. Hatuhifadhi nakala kwa kuvinjari baadaye, mafunzo, au wasifu wa matangazo. Tazama Sera ya Faragha kwa maelezo ya uhifadhi na ufichuzi wa vidakuzi vya AdSense.

Maswali ya kawaida

Kwa nini matokeo ni ZIP?
pdftohtml inaandika faili nyingi; zinazofungashwa.
Je, HTML italingana na mpangilio wa PDF?
Ni mauzo ya Poppler, si CSS ya kivinjari kamili.
Naweza kugeuza skani kuwa maandishi ya HTML?
Hapana. Si OCR. Tumia OCR kuwa Markdown.
Je, inafanyika katika kivinjari?
Hapana. Seva inaendesha pdftohtml.

Ilisasishwa mwisho:

Tumia kutoka msimbo

Kila zana hapa ni REST. Matumizi bila kujisajili hayahitaji akaunti wala ufunguo wa API. Inafaa kivinjari, watengenezaji, na mawakala wa AI.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Pia inapatikana kama zana ya MCP kwa programu zinazotumia Model Context Protocol (JSON-RPC 2.0, POST /mcp). Maelezo kamili ya API

Itumie kupitia wakala wa AI

Skill

Ukiwa na skill hii, Claude Code, Codex, Cursor na mawakala wengine wa AI wanaweza kukuendeshea "PDF kuwa HTML": /skills/pdf123-pdf-to-html.md

Skill zote za mawakala

Faili inatumika kazi hii tu, kisha inafutwa yenyewe.