PPDF123
Formats2026-09-202 menit baca

Apa isi di dalam PDF: objek, stream, dan tabel cross-reference

PDF adalah graf objek bernomor, stream terkompres, dan tabel xref berisi offset byte; Get Info memeriksanya, Repair membangun ulang struktur saat peta itu rusak.

PDF123 Β· Updated 2026-09-20

PDF bukan tumpukan halaman yang datar. Ia adalah basis data kecil berisi objek, banyak di antaranya disimpan sebagai stream terkompres dan ditemukan lewat tabel cross-reference (xref), sehingga pembaca bisa melompat langsung ke objek 17 tanpa memindai seluruh berkas. Ketika peta itu rusak, penampil menyebut berkasnya rusak meski byte halaman masih ada di disk.

Objek

Semua bagian yang menarik (halaman, font, gambar, metadata, katalog dokumen) adalah objek bernomor. Halaman menunjuk ke content stream dan sumber daya; sumber daya menunjuk ke font dan XObject; katalog menunjuk ke pohon halaman. Alat yang menggabungkan, memutar, atau mengecap halaman umumnya menulis ulang graf itu, bukan menggambar ulang pikselnya.

Stream

Stream adalah objek yang muatannya berupa rangkaian byte, sering dikompres dengan Flate: operator konten halaman, berkas font tertanam, data gambar. Karena itulah membuka PDF di editor teks memperlihatkan campuran token ASCII dan gumpalan biner. Mengembangkan stream (tanpa mengubah tampilan halaman) berguna untuk menelusuri masalah; Compress di situs ini merekompres stream tersebut dengan qpdf, dan tidak menurunkan resolusi gambar atau menyubset font.

Tabel cross-reference

Di dekat akhir berkas pada umumnya, ada bagian xref (atau xref stream pada berkas yang lebih baru) yang mencantumkan offset byte untuk setiap nomor objek. Pembaca melompat ke offset itu. Unduhan yang terpotong, penggabungan yang buruk, dan penyimpanan yang tidak tuntas sering meninggalkan trailer yang menunjuk ke offset yang sudah tidak cocok lagi. Piksel halaman pertama mungkin masih ada; peta yang menemukan "halaman pertama" sudah tidak ada.

Itulah sebabnya perbaikan struktural adalah pekerjaan yang berbeda dari OCR atau membuka kunci: repair membangun ulang struktur internal dari sisa-sisa yang valid; ia tidak menciptakan gambar halaman yang hilang atau menebak kata sandi.

Periksa sebelum menulis ulang

Get Info on PDF mengembalikan laporan JSON (jumlah halaman, metadata, font, detail struktural), bukan PDF yang sudah diubah. Gunakan saat Anda perlu tahu apa yang sedang Anda pegang sebelum menjalankan compress, convert, atau repair.

Jika penampil sama sekali menolak membuka berkasnya, coba Repair PDF, yang membangun ulang struktur termasuk pemulihan cross-reference. Jika berkasnya terbuka tetapi teks hasil pindai tidak bisa dipilih, itu masalah OCR, bukan masalah xref.

Urutan keputusan singkat

  1. Berkas tidak mau terbuka β†’ Repair lebih dulu.
  2. Berkas terbuka; Anda membutuhkan fakta (jumlah halaman, font, petunjuk enkripsi) β†’ Get Info.
  3. Strukturnya baik; Anda ingin berkas lebih kecil atau teks terbaca dari hasil pindai β†’ Compress untuk ukuran, atau OCR untuk teks Markdown, bukan satu putaran repair lagi.

Get Info maupun Repair berjalan tanpa akun. Untuk operasi yang sama lewat HTTP, lihat Developers. Untuk perbedaan Repair dengan produk "recovery" desktop bermerek, lihat Repair PDF online vs pencarian Recovery Toolbox.

Open tool
Process in the browser β€” no watermark, files removed after the job.
Open tool