Formats2026-09-202 dk okuma

Bir PDF’nin içinde ne var: nesneler, akışlar ve çapraz başvuru tablosu

PDF numaralı nesneler, sıkıştırılmış akışlar ve bayt ofsetli bir xref grafiğidir. Get Info dosyayı inceler; harita bozulunca Repair yapıyı yeniden kurar.

PDF123 · Updated 2026-09-20

PDF düz bir sayfa dökümü değildir. Numaralı nesnelerden oluşan küçük bir veritabanıdır; bunların çoğu sıkıştırılmış akışlar olarak saklanır ve bir okuyucunun tüm dosyayı taramadan 17. nesneye atlayabilmesi için bir çapraz başvuru tablosu (xref) ile konumlanır. Bu harita bozulduğunda, sayfa baytları diskte duruyor olsa bile görüntüleyiciler dosyayı hasarlı sayar.

Nesneler

İlginç olan her şey (sayfalar, yazı tipleri, görüntüler, üstveri, belge kataloğu) bir numarası olan bir nesnedir. Sayfalar içerik akışlarına ve kaynaklara işaret eder; kaynaklar yazı tiplerine ve XObject’lere işaret eder; katalog sayfa ağacına işaret eder. Birleştiren, döndüren veya damgalayan araçlar çoğunlukla pikselleri yeniden çizmek yerine bu grafiği yeniden yazar.

Akışlar

Bir akış, yükü bir bayt dizisi olan bir nesnedir; çoğu zaman Flate ile sıkıştırılmıştır: sayfa içeriği operatörleri, gömülü yazı tipi dosyaları, görüntü verisi. Bir PDF’yi bir metin düzenleyicide açmanın ASCII token’lar ile ikili blob’ların karışımını göstermesinin nedeni budur. Akışları (sayfaların görünümünü değiştirmeden) genişletmek hata ayıklama için yararlıdır; bu sitede Compress bu akışları qpdf ile yeniden sıkıştırır; görüntüleri seyreltmez veya yazı tiplerini alt kümelemez.

Çapraz başvuru tablosu

Tipik bir dosyanın sonuna doğru, bir xref bölümü (ya da yeni dosyalarda bir xref akışı) her nesne numarası için bayt ofsetlerini listeler. Okuyucular bu ofsetlere atlar. Kesilmiş indirmeler, kötü birleştirmeler ve yarım yazılmış kaydetmeler çoğu zaman trailer’ı artık eşleşmeyen ofsetlere işaret eder bırakır. Birinci sayfanın pikselleri hâlâ var olabilir; “birinci sayfa”yı bulan harita yoktur.

Bu yüzden yapısal onarım, OCR veya kilidi açmaktan farklı bir iştir: onarım iç yapıyı geçerli kalıntılardan yeniden kurar; eksik sayfa resmini uydurmaz veya bir parolayı tahmin etmez.

Yeniden yazmadan önce inceleyin

Get Info on PDF, değiştirilmiş bir PDF değil bir JSON raporu (sayfa sayısı, üstveri, yazı tipleri, yapısal ayrıntılar) döner. Sıkıştırma, dönüştürme veya onarımdan önce elinizde ne olduğunu bilmeniz gerektiğinde bunu kullanın.

Bir görüntüleyici dosyayı hiç açmıyorsa, çapraz başvuru kurtarma dahil yapıyı yeniden kuran Repair PDF aracını deneyin. Dosya açılıyor ama taranmış metin seçilemiyorsa bu bir xref sorunu değil, bir OCR sorunudur.

Kısa bir karar sırası

  1. Dosya açılmıyor → önce Repair.
  2. Dosya açılıyor; olgulara ihtiyacınız var (sayfalar, yazı tipleri, şifreleme ipuçları) → Get Info.
  3. Yapı iyi; bir taramadan daha küçük bir dosya ya da okunabilir metin istiyorsunuz → boyut için Compress, Markdown metni için OCR; bir onarım turu daha değil.

Get Info ve Repair de hesap gerektirmeden çalışır. Aynı işlemleri HTTP üzerinden yapmak için Geliştiriciler sayfasına bakın. Repair’ın markalı masaüstü “kurtarma” ürünlerinden nasıl ayrıldığı için Çevrimiçi PDF onarımı ile Recovery Toolbox aramaları yazısına bakın.

Open tool
Process in the browser — no watermark, files removed after the job.
Open tool