PDF/A とは:アーカイブ PDF は想像しているより別の形式である
PDF/A はフォントを埋め込み外部依存を禁じ、何十年後も同じ見た目で描画される。PDF123 は各 PDF/A レベルへ変換する。PDF/X は別の印刷標準だ。

PDF/A は長期保存のために作られた、制約付きの PDF サブセットだ。ページを描画するのに必要なものはすべてファイルの中を移動する。今日開ける普通の PDF でも、システムフォントや外部リソース、将来のビューアが持たない対話機能に依存していれば、明日のアーカイブ検査に落ちうる。
「アーカイブ」が実際に制約するもの
PDF/A はフォントの埋め込みを必須とし、外部依存と一部の動的な内容(スクリプト、一部のマルチメディア、外部データを必要とする動的なフォーム挙動)を認めない。要点は再現性だ。10 年後、30 年後に開いても同じ字形とレイアウトが得られ、元のマシンのフォントフォルダが残っていることを祈らずに済む。
これは「Preview で問題なく見える」とは別の仕事だ。日常的な PDF は編集のしやすさと小さなダウンロードを最適化する。PDF/A は自己完結性を最適化する。
適合レベルはマーケティングの階層ではない
ISO の PDF/A には世代(1、2、3)と適合クラスがある。「b」の変種(PDF/A-2b、PDF/A-3b など)は視覚的な忠実さに焦点を当て、より厳しいクラスは構造とタグ付きコンテンツの要件を足す。裁判所、政府のポータル、記録システムは通常、正確なレベルを指定する。推測を外すと、ファイルが「アーカイブらしく見えても」拒否される。
PDF123 では PDF から PDF/A が outputFormat セレクタを公開し、pdfa、pdfa-1、pdfa-2、pdfa-2b、pdfa-3、pdfa-3b、pdfx を選べる。受け取る側が文書化しているものを選ぶ。変換経路は Ghostscript で PDF/A に向かう(形式名に 1 が含まれれば PDFA レベル 1、それ以外はレベル 2)。メニューのラベルはその経路への入力であり、すべての ISO クラスや印刷 RIP のプロファイルを保証するものではない。
PDF/A と PDF/X
PDF/A は長期的な閲覧と記録の保持を狙う。PDF/X は印刷生産を狙う。色空間、塗り足し、プリプレス上の制約によって、印刷 RIP に予測可能なジョブを渡すためのものだ。どちらも ISO の PDF サブセットだが、失敗の仕方が違う。本製品の変換ツールはアーカイブ(PDF/A)の経路だ。印刷所が PDF/X を求めてきたら、実際に PDF/X を出力するプリプレス工程を使うべきで、アーカイブ変換だけでは足りない。
変換が直さないもの
PDF/A への変換は、埋め込んだことのないフォントを生み出さないし、壊れた xref を直さないし、スキャンをタグ付きのアクセシブルな文書にもしない。適合プロファイルに向けてファイルを書き換えるだけだ。元のファイルが厳格な規則(埋め込み不能なフォント、禁止された内容)にすでに反していれば、変換は失敗するか、日常の編集にまだ必要な機能を剥ぎ取る。
チェックリストがレベルを指定している場合は PDF から PDF/A を使う。同じエンドポイント(POST /api/v1/convert/pdf/pdfa)を自動化から叩く場合は 開発者向け を参照してほしい。