Taranmış PDF'ye OCR Uygulayıp Markdown Alın
OCR'den Markdown'a, taranmış ya da görüntü tabanlı bir PDF'yi okur ve metnini Markdown dosyası olarak döndürür. PDF'ye metin katmanı eklemez ve özgün dosya değişmez.
Dosyaları buraya sürükleyip bırakın veya seçmek için tıklayın
PDF kabul edilir · dosya başına en fazla 500.0 MB · bir seferde en fazla 20 dosya
Bir dosyayı Ctrl/Cmd+V ile veya pano menüsünden de yapıştırabilirsiniz.
OCR'den Markdown'a, taramaları veya salt görüntü PDF'leri okuyup Markdown döner (`text/markdown`, dosya adı `.md`). Gizli metin katmanını PDF'ye yazmaz; taramayı temizlemez, düzeltmez veya yeniden yazmaz.
Sunucu PDF'deki yerli metni, görüntü sayfalarının optik tanıma sonucuyla birleştirir. Force OCR (`ocrType=force-ocr`, site varsayılanı) her sayfayı yeniden tanır. Normal (`force-ocr` değilse) yerli metin varsa onu kullanır; yalnızca salt görüntü sayfalarında OCR yapar. Temiz elektronik PDF'te Auto OCR çalışma ortamını yüklemez.
Doğruluk tarama kalitesi, karşıtlık ve eğime bağlıdır. Mevcut motorda dil parametresi yoktur. İstemci eski Java OCRmyPDF alanlarını (`languages`, `deskew`, `clean`, `sidecar`) gönderirse yok sayılır.
Bu, PDF'den Word'e veya PDF'den RTF'ye (metin) ön adımı değildir. O araçlar hâlâ PDF içinde metin ister. Buradaki OCR paralel çıkarmadır: Markdown alırsınız, özgün PDF değişmez.
Sayısallaştırma veya yeniden dağıtma hakkınız olmayan dosyalarda OCR yapmayın. Çıkarılan metin de telif ve işyeri kurallarına tabidir.
Aranabilir PDF isteyenlere burası vermez. Aranabilir ürün Markdown dosyasıdır. Düzenleyicide açıp doğru olması gereken ad ve rakamları örnekleyin.
Telefon fotoğraflarını yüklemeden önce kırpıp düzeltin. Yamuk çekimler tanımayı arka plana harcar. OCR çeviri değildir: karakter tanır; belgeyi başka dile yeniden yazmaz.
Görev sunucuda çalışır. Zamanında indirin. Dosyalarınızı OCR kitaplığı yapmayız. Parola korumalı dosyaların kilidi, parolayı girdiğinizde bu sayfada sizin için açılır; API çağıranları önce Parolayı kaldır çalıştırır.
Özellikler
- Markdown döner; OCR katmanlı PDF değil
- Force OCR her sayfayı yeniden okur; Normal/Auto yerli metin varsa onu kullanır
- Özgün PDF değişmez
- Anonim API: /api/v1/misc/ocr-pdf
Bu araç ne zaman kullanılır
- Arşiv taramalarından madde metni çıkarmak
- Markdown isteyen aracı veya hatlara tarama vermek
- Metin katmanı olmayan salt görüntü PDF'ten yazıyı geri almak
Taranmış PDF'ye OCR'ı nasıl uygularım?
- Tarama veya telefonla çekilmiş PDF yükleyin.
- Force OCR (varsayılan) veya Normal/Auto seçin.
- İşle'ye tıklayın ve `.md` indirin.
- Markdown'da ad ve rakamları örnekleyip sonra kullanın.
Sınırlar ve özel durumlar
- Doğruluk görüntü kalitesine göre değişir
- Çok sayfada süre uzar
- Mevcut motorda dil parametresi yok
- Yerel OCR kitaplığı veya çevrimdışı SDK değildir
- Bu sitedeki yükleme sınırı: dosya başına 500 MB; yaklaşık 95 MB üzerindeki dosyalar parçalar hâlinde gönderilir. Doğrudan tek bir API isteğinin gövdesi 100 MB ile sınırlıdır.
Örnekler
- 20 sayfalık gri ton sözleşme taraması madde metinli Markdown olur
- Eğik telefon çekimleri yararlı OCR için yeniden çekilmeyi gerektirebilir
Bu araç için gizlilik
Dosyalar HTTPS üzerinden yüklenir, bellek içinde veya sunucularımızdaki kısa ömürlü geçici bir dizinde işlenir ve sonucunuz hazır olduğunda silinir. Daha sonra gezinme, eğitim veya reklam profilleri için kopya tutmayız. Saklama ayrıntıları ve AdSense çerez bildirimleri için Gizlilik Politikası'na bakın.
Sık sorulan sorular
- OCR sayfa görünümünü değiştirir mi?
- PDF döndürmez. Özgün dosya değişmez; ayrıca bir Markdown indirmesi alırsınız.
- Bu gömülebilir OCR kitaplığı mı?
- Hayır. /api/v1/misc/ocr-pdf üzerinde barındırılan HTTP görevidir. Bkz. /developers. Bağlanabilir SDK değildir.
- OCR'den sonra Word'e dönüştürülebilir mi?
- PDF hattı gibi zincirlenemez. OCR çıktısı Markdown'dır. Word dönüşümü hâlâ metin katmanlı PDF ister.
- Elektronik PDF Force OCR ister mi?
- Genelde hayır. Normal/Auto var olan metni kullanır ve OCR çalışma ortamını atlar. Metin katmanı bozuk veya güvenilmezse Force kullanın.
Son güncelleme:
Koddan çağırın
Bu sitedeki her araç düz bir REST arayüzüdür. Anonim kullanım için hesap veya API anahtarı gerekmez. Tarayıcı, geliştirici ve yapay zeka ajanları için aynı şekilde kullanılabilir.
curl -X POST "https://pdf123.xyz/api/v1/misc/ocr-pdf" \
-F "[email protected]" \
-F "ocrType=force-ocr" \
-o output.pdfModel Context Protocol konuşan ajan istemcileri için MCP aracı olarak da kullanılabilir (JSON-RPC 2.0, POST /mcp). Tam API belgesi
Bir yapay zekâ ajanıyla kullanın
BeceriBu beceriyle Claude Code, Codex, Cursor ve diğer yapay zekâ ajanları sizin için "OCR'den Markdown'a" işlemini yapabilir: /skills/pdf123-ocr.md
Dosyalar yalnızca bu işlem için kullanılır ve ardından otomatik silinir.