Formats2026-09-264 min de lectura

De Markdown a PDF i tornada: què conserva la conversió de format

Markdown↔PDF conserva encapçalaments, llistes i taules simples millor que els píxels. Les fonts exactes i la paginació no sobreviuen del tot.

PDF123 · Updated 2026-09-26

Markdown i PDF optimitzen contractes diferents. Markdown és estructura amigable amb el control de versions. PDF és una descripció fixa de pàgina. Convertir en una direcció i tornar enrere és útil, però no és un cicle d'arxiu sense pèrdua.

De Markdown a PDF: l'estructura es converteix en pàgines

Markdown a PDF (POST /api/v1/convert/markdown/pdf) accepta un fitxer .md o un ZIP que contingui Markdown. Les càrregues que no són Markdown ni ZIP es rebutgen. L'UTF-8 és obligatori per a una entrada .md simple. La canalització representa el Markdown com a HTML amb taules, ratllat i llistes de tasques activats, embolcalla aquell HTML en CSS orientat a impressió (incloent-hi piles de fonts per a diversos alfabets i RTL quan es detecta àrab) i l'imprimeix a PDF amb WeasyPrint.

El que sol sobreviure a la passada d'anada:

  • Els encapçalaments, els paràgrafs, les llistes i les taules Markdown simples
  • El text de diversos alfabets que el camí HTML pot compondre (CJK, llatí i altres alfabets coberts pel CSS d'impressió)
  • Un PDF imprimible i compartible per a fluxos de treball de documentació com a codi

El que no:

  • Les fonts del tema del vostre editor com una coincidència garantida a tots els visors
  • Els salts de línia exactes de la pantalla del fitxer .md
  • Les funcions interactives de Markdown que no tenen equivalent en PDF (caselles en directe, seccions plegables, enllaços wiki)

Una entrada ZIP serveix per empaquetar Markdown amb recursos que el camí HTML pot resoldre al costat del document. Tracteu-la com una comoditat d'empaquetatge, no com la garantia que cada imatge relativa o referència CSS es veurà igual a tots els visors.

De PDF a Markdown: entra la capa de text, surt el Markdown

PDF a Markdown (POST /api/v1/convert/pdf/markdown) extreu el contingut textual a Markdown amb pdf-inspector. La resposta és text/markdown, que es descarrega com a fitxer .md. Els PDF natius digitals amb capa de text neta es converteixen millor. Les pàgines escanejades sense capa de text donen un Markdown buit o inservible fins que els passeu abans per OCR, que aquí també retorna Markdown, no una capa de PDF cercable.

Espereu:

  • Encapçalaments i paràgrafs quan les heurístiques de mida de font encerten (potser hàgiu de renumerar a mà els nivells de #)
  • Taules com a taules Markdown quan el reconeixement funciona; les composicions de diverses columnes poden linealitzar-se en un ordre de lectura diferent
  • Capçaleres i peus corrents repetits a cada pàgina (retalleu-los després)
  • Que les imatges i les equacions com a imatges no es converteixin automàticament en recursos locals ni LaTeX

Si necessiteu prosa plana sense heurístiques d'encapçalament, PDF a text és l'extracció més plana. Les exportacions en forma de taula que retornen HTTP 204 volen dir que no s'ha detectat cap bloc columnar; vegeu Exportació de taula buida (204).

Què demostra realment una anada i tornada

Sobrevius raonablement Normalment no
Paraules, jerarquia d'encapçalaments i estructura de llistes Geometria de pàgina perfecta al píxel
Taules simples com a text Fonts i interletratge exactes
Un esborrany funcional per a Git o per a agents Paginació idèntica a la impressió

Fer l'anada i tornada dues vegades introdueix divergència. Markdown→PDF torna a compondre el text amb WeasyPrint; PDF→Markdown reconstrueix l'estructura a partir d'heurístiques d'extracció. Cap dels dos passos no desa un intermedi sense pèrdua del model de composició de l'altre format.

Trieu una direcció canònica

Si necessiteu la composició d'impressió com a sistema de registre, conserveu el PDF i tracteu Markdown com una exportació o alimentació per a agents. Si necessiteu diffs, revisió de codi i ingestió per agents, preferiu Markdown i tracteu PDF com el pas de publicació. No deseu tots dos com a «fonts de veritat» iguals i espereu que continuïn sent idèntics després de les edicions.

Un bucle pràctic de documentació com a codi: editeu Markdown a Git → Markdown a PDF per a l'artefacte compartible → eviteu PDF→Markdown→PDF com a hàbit diari. Feu servir PDF→Markdown quan hereteu un PDF natiu digital i necessiteu text per a un agent; després tracteu aquell Markdown com un esborrany nou, no com una garantia de la paginació original.

Els fitxers xifrats necessiten un Desbloqueja autoritzat abans de qualsevol de les dues conversions. Els fitxers danyats que no es poden analitzar haurien de passar primer per Get Info / Reparar. Per als mateixos punts de destinació per HTTP, vegeu Desenvolupadors.

Open tool
Process in the browser — no watermark, files removed after the job.
Open tool