Ana içeriğe geç
PPDF123

PDF'yi HTML'ye Dönüştürün

PDF'den HTML'ye, bir PDF'yi Poppler'ın pdftohtml aracıyla dönüştürür ve HTML sayfaları ile görüntülerini içeren bir ZIP sunar. Temiz web işaretlemesi değil, bir düzen dökümüdür; OCR yapmaz.

Dosyaları buraya sürükleyip bırakın veya seçmek için tıklayın

PDF kabul edilir · dosya başına en fazla 500.0 MB · bir seferde en fazla 20 dosya

Bir dosyayı Ctrl/Cmd+V ile veya pano menüsünden de yapıştırabilirsiniz.

PDF'den HTML'ye, Poppler `pdftohtml -c` çalıştırır ve aracın çıktı dizinine yazdıklarını ZIP'e koyar. İndirme adı `{base}ToHtml.zip`'tir; tek `.html` değildir. Hedef tarayıcı düzeyinde CSS değil, Poppler'in HTML ve görüntü dışa aktarımıdır.

Bu sayfada form alanı yoktur. Her sayfa dönüşür. `pdftohtml` hiçbir şey yazmazsa arayüz boş ZIP değil iç hata döner.

OCR değildir. Salt görüntü taramalar HTML paketindeki görüntü olur; seçilebilir metin değil. Parola korumalı dosyaların kilidi, parolayı girdiğinizde bu sayfada sizin için açılır; API çağıranları önce Parolayı kaldır çalıştırır.

Yalnızca metin istiyorsanız PDF'den RTF'ye (metin) kullanın. CMS'e uygun yazı için PDF'den Markdown'a kullanın.

Özellikler

  • Poppler `pdftohtml -c`; HTML ve kaynakların ZIP'i
  • Sayfa aralığı veya tema seçeneği yok
  • OCR değildir; taramalar pakette görüntü kalır
  • Anonim API: /api/v1/convert/pdf/html

Bu araç ne zaman kullanılır

  • Metin katmanlı PDF'ten kaba HTML almak
  • pdftohtml'in çıkardığı sayfa görüntülerini almak
  • Kendi hattınızdan önce Poppler'in dosyayı nasıl anladığına bakmak

PDF'yi HTML'ye nasıl dönüştürürüm?

  1. PDF yükleyin. Bu sayfada dönüşüm seçeneği yoktur.
  2. İşle'ye tıklayın ve `{name}ToHtml.zip` indirin.
  3. Açtıktan sonra tarayıcıda HTML'i açın.
  4. Görüntü ve yazıyı denetleyin. Taramalar gerçek HTML metni olmaz.

Sınırlar ve özel durumlar

  • Çıktı ZIP'tir; tek HTML değildir
  • Chromium yazdırma veya etiketli PDF HTML dışa aktarımı değildir
  • pdftohtml boş çıktısı hatadır; 204 değildir
  • Bu sitedeki yükleme sınırı: dosya başına 500 MB; yaklaşık 95 MB üzerindeki dosyalar parçalar hâlinde gönderilir. Doğrudan tek bir API isteğinin gövdesi 100 MB ile sınırlıdır.

Örnekler

  • Basit metin not çoğu zaman bir HTML artı birkaç görüntü açar
  • Salt tarama PDF'in HTML'i çoğunlukla o sayfa görüntülerini sarar

Bu araç için gizlilik

Dosyalar HTTPS üzerinden yüklenir, bellek içinde veya sunucularımızdaki kısa ömürlü geçici bir dizinde işlenir ve sonucunuz hazır olduğunda silinir. Daha sonra gezinme, eğitim veya reklam profilleri için kopya tutmayız. Saklama ayrıntıları ve AdSense çerez bildirimleri için Gizlilik Politikası'na bakın.

Sık sorulan sorular

Sonuç neden ZIP?
pdftohtml HTML artı çıkarılan görüntüleri bir klasöre yazar. Sunucu o klasörü paketler.
HTML PDF düzeniyle aynı mı kalır?
Yalnızca Poppler `-c` kipinin ölçüsünde. Çok sütunlu dergiler ve bol vektör çoğu zaman hizalanmaz.
Tarama HTML metnine dönüşür mü?
Hayır. Bu yol OCR yapmaz. Metin için OCR'den Markdown'a kullanın.
Tarayıcıda mı dönüştürülür?
Hayır. Sunucu pdftohtml çağırır.

Son güncelleme:

Koddan çağırın

Bu sitedeki her araç düz bir REST arayüzüdür. Anonim kullanım için hesap veya API anahtarı gerekmez. Tarayıcı, geliştirici ve yapay zeka ajanları için aynı şekilde kullanılabilir.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/html" \
  -F "[email protected]" \
  -o output.pdf

Model Context Protocol konuşan ajan istemcileri için MCP aracı olarak da kullanılabilir (JSON-RPC 2.0, POST /mcp). Tam API belgesi

Bir yapay zekâ ajanıyla kullanın

Beceri

Bu beceriyle Claude Code, Codex, Cursor ve diğer yapay zekâ ajanları sizin için "PDF'den HTML'ye" işlemini yapabilir: /skills/pdf123-pdf-to-html.md

Tüm ajan becerileri

Dosyalar yalnızca bu işlem için kullanılır ve ardından otomatik silinir.