Formats2026-09-202 min läsning

Vad som finns i en PDF: objekt, strömmar och korsreferenstabellen

En PDF är en graf av numrerade objekt, komprimerade strömmar och en xref med bytepositioner. Dokumentinfo granskar filen; Reparera bygger om när kartan går sönder.

PDF123 · Updated 2026-09-20

En PDF är inte en platt utskrift av sidor. Det är en liten databas av objekt, många lagrade som komprimerade strömmar, som hittas via en korsreferenstabell (xref) så att läsaren kan hoppa direkt till objekt 17 utan att skanna hela filen. När kartan går sönder kallar läsarna filen skadad, även om sidornas byte fortfarande ligger på disken.

Objekt

Allt intressant (sidor, teckensnitt, bilder, metadata, dokumentkatalogen) är ett objekt med ett nummer. Sidor pekar på innehållsströmmar och resurser, resurser pekar på teckensnitt och XObject, och katalogen pekar på sidträdet. Verktyg som slår ihop, roterar eller stämplar skriver oftast om den grafen i stället för att rita om pixlar.

Strömmar

En ström är ett objekt vars innehåll är en bytesekvens, ofta Flate-komprimerad: sidinnehållets operatorer, inbäddade teckensnittsfiler, bilddata. Det är därför en PDF i en textredigerare visar en blandning av ASCII-token och binära klumpar. Att expandera strömmarna (utan att ändra hur sidorna ser ut) är användbart vid felsökning; Komprimera PDF hos oss komprimerar om strömmarna med qpdf, utan att sampla ner bilder eller subsetta teckensnitt.

Korsreferenstabellen

Nära slutet av en typisk fil listar ett xref-avsnitt (eller en xref-ström i nyare filer) bytepositionerna för varje objektnummer. Läsarna söker sig till de positionerna. Avbrutna nedladdningar, misslyckade sammanslagningar och halvfärdiga sparningar lämnar ofta trailer-posten pekande på positioner som inte längre stämmer. Pixlarna på första sidan kan finnas kvar, men kartan som hittar ”första sidan” gör det inte.

Det är därför strukturell reparation är en annan uppgift än OCR eller upplåsning: reparationen bygger om den inre strukturen från giltiga rester, men hittar inte på saknad sidkonst eller gissar ett lösenord.

Granska innan du skriver om

Dokumentinfo returnerar en JSON-rapport (sidantal, metadata, teckensnitt, strukturella detaljer), inte en ändrad PDF. Använd den när du behöver veta vad du har framför dig innan du komprimerar, konverterar eller reparerar.

Om en läsare vägrar öppna filen helt, prova Reparera PDF, som bygger om strukturen inklusive återställning av korsreferenser. Om filen öppnas men skannad text inte går att markera är det ett OCR-problem, inte ett xref-problem.

En kort beslutsordning

  1. Filen går inte att öppna → Reparera PDF först.
  2. Filen öppnas och du behöver fakta (sidor, teckensnitt, tecken på kryptering) → Dokumentinfo.
  3. Strukturen är hel och du vill ha en mindre fil eller läsbar text från en skanning → Komprimera PDF för storleken, eller OCR för Markdown-text, inte ännu en reparationsrunda.

Både Dokumentinfo och Reparera körs utan konto. För samma operationer över HTTP, se Utvecklare. För hur Reparera skiljer sig från varumärkta skrivbordsprodukter för ”recovery”, se PDF-reparation online mot sökningar på Recovery Toolbox.

Open tool
Process in the browser — no watermark, files removed after the job.
Open tool