Från Markdown till PDF och tillbaka: vad formatkonvertering bevarar
Markdown↔PDF bevarar rubriker, listor och enkla tabeller bättre än pixlar. Exakta teckensnitt, paginering och layout överlever inte som en förlustfri tur och retur.

Markdown och PDF är optimerade för olika kontrakt. Markdown är struktur som passar versionshantering. PDF är en fast sidbeskrivning. Att konvertera åt ena hållet och tillbaka är användbart, men det är inte en förlustfri arkivcykel.
Markdown till PDF: struktur blir sidor
Markdown till PDF (POST /api/v1/convert/markdown/pdf) tar emot en .md-fil eller en ZIP som innehåller Markdown. Uppladdningar som varken är Markdown eller ZIP avvisas. För vanliga .md-filer krävs UTF-8. Kedjan renderar Markdown till HTML med tabeller, genomstrykning och uppgiftslistor aktiverade, klär HTML:en i tryckanpassad CSS (inklusive typsnittsstackar för flera skriftsystem och RTL när arabiska upptäcks) och skriver sedan ut till PDF med WeasyPrint.
Det som brukar överleva den framåtriktade vägen:
- Rubriker, stycken, listor och enkla Markdown-tabeller
- Text i flera skriftsystem som HTML-vägen kan lägga ut (CJK, latin och andra skriftsystem som tryck-CSS:en täcker)
- En utskrivbar, delbar PDF för arbetsflöden med dokument som kod
Det som inte överlever:
- Att din editors tematypsnitt garanterat matchar i varje läsare
- Exakta radbrytningar från
.md-filen så som de såg ut på skärmen - Interaktiva Markdown-funktioner som saknar motsvarighet i PDF (levande kryssrutor, hopfällbara avsnitt, wikilänkar)
En ZIP som indata är till för att paketera Markdown tillsammans med resurser som HTML-vägen kan hitta bredvid dokumentet. Betrakta det som en praktisk paketering, inte som en garanti för att varje relativ bild- eller CSS-referens ser likadan ut i varje läsare.
PDF till Markdown: textlagret in, Markdown ut
PDF till Markdown (POST /api/v1/convert/pdf/markdown) extraherar textinnehåll till Markdown via pdf-inspector. Svaret är text/markdown som laddas ner som en .md-fil. Digitalt skapade PDF:er med ett rent textlager konverteras bäst. Skannade sidor utan textlager ger tom eller oanvändbar Markdown tills du kör OCR först, och OCR hos oss returnerar också Markdown, inte ett sökbart lager i PDF:en.
Räkna med:
- Rubriker och stycken när heuristiken för teckenstorlek slår rätt (du kan ändå behöva numrera om
#-nivåerna för hand) - Tabeller som Markdown-tabeller när igenkänningen fungerar; layouter i flera kolumner kan linjäriseras i en annan läsordning
- Sidhuvuden och sidfötter som upprepas på varje sida (ta bort dem i efterhand)
- Bilder och ekvationer som är bilder, vilka inte automatiskt blir lokala resurser eller LaTeX
Behöver du vanlig prosa utan heuristik för rubriker är PDF till text den plattare extraktionen. Tabellexporter som returnerar HTTP 204 betyder att inga kolumnblock hittades; se Tom tabellexport (204).
Vad en tur och retur faktiskt visar
| Överlever rimligt | Gör det oftast inte |
|---|---|
| Ord, rubrikhierarki, liststruktur | Pixelperfekt sidgeometri |
| Enkla tabeller som text | Exakta teckensnitt och kerning |
| Ett fungerande utkast för Git eller agenter | Tryckidentisk paginering |
Att köra rundturen två gånger gör att resultatet glider isär. Markdown till PDF flödar om genom WeasyPrint, och PDF till Markdown bygger om strukturen utifrån extraktionens heuristik. Inget av stegen sparar en förlustfri mellanform av det andra formatets layoutmodell.
Välj en kanonisk riktning
Behöver du trycklayouten som system of record behåller du PDF:en och behandlar Markdown som export eller flöde för agenter. Behöver du diffar, kodgranskning och att agenter kan läsa in innehållet föredrar du Markdown och behandlar PDF:en som publiceringssteget. Lagra inte båda som likvärdiga ”sanningar” och förvänta dig att de förblir identiska efter ändringar.
En praktisk slinga för dokument som kod: redigera Markdown i Git → Markdown till PDF för den delbara produkten → undvik PDF till Markdown till PDF som daglig vana. Använd PDF till Markdown när du har ärvt en digitalt skapad PDF och behöver texten för en agent, och behandla då den Markdown-texten som ett nytt utkast, inte som en garanti för originalets paginering.
Krypterade filer behöver en behörig upplåsning via Ta bort lösenord före båda konverteringarna. Skadade filer som inte går att tolka bör först gå genom Dokumentinfo eller Reparera PDF. För samma slutpunkter över HTTP, se Utvecklare.