PDF 在线修复,与 “Recovery Toolbox” 搜索:PDF123 实际做什么
“PDF recovery toolbox”这类搜索多指结构修复。PDF123 提供免费在线修复工具与修复 PDF API,不是桌面恢复产品。

PDF 打不开时,搜索结果常把两件不同的事混在一起:修复损坏文件的结构,和品牌化的桌面“恢复”软件。PDF123(pdf123.xyz)以 PDF Toolbox 之名发布,提供的是前者:一个免费在线工具加一个修复 PDF API。它不是以 Recovery Toolbox for PDF 之名售卖的那款 Windows 产品。
对损坏的 PDF,“修复”指的是什么
抛出“文件已损坏”或干脆打不开的 PDF,通常是内部映射坏了(交叉引用或对象流出问题),而不是缺了你能手工重画的页面图片。修复 PDF(POST /api/v1/misc/repair)的做法是用 qpdf 从仍然有效的字节重写文件,从而重建这份结构。恢复成功时,查看器可以重新打开文件,页面内容的本意不变。
这和下面几种情况不同:
- OCR / 扫描清理:文件能打开,但文字只是图像(本站 OCR 返回 Markdown,不是隐藏文本层)
- 密码解锁:文件被加密,而你已知密码(解锁)
- 桌面恢复套件:装在本机、面向深度取证恢复的应用
- 压缩 / 转换:处理体积和格式的工具,前提是先有一份可解析的 PDF
在线工具箱与桌面 “Recovery Toolbox” 搜索
| 需求 | PDF123 修复 PDF | 典型桌面恢复产品 |
|---|---|---|
| 怎么运行 | 浏览器上传或用 HTTP API | 在 PC 上安装并运行 |
| 这里的主要工作 | 结构修复,让 PDF 能打开 | 各厂商特定的恢复流程(因产品而异) |
| 自动化 | 修复 PDF API,即 POST /api/v1/misc/repair |
通常是 GUI 或本地批处理,不是我们的 OpenAPI |
| 账号 | 目录工具不需要 | 取决于厂商 |
我们不声称与 Recovery Toolbox for PDF 在功能、价格或版本细节上对等,那是另一款产品。这张表只澄清渠道与意图:在线 API 修复,和人们在 Google 里敲进去的桌面恢复品牌不是一回事。
动手修复前先做预检
获取信息 返回一份 JSON 预检(FileSize、PageCount、Encrypted、Info 字段和版本号)。用它判断解析器能否加载文件,以及是不是加密挡住了其他编辑。修复不会移除密码。“文件打不开”的逐步决策树见文件打不开:先 Get Info,再 Repair,然后别瞎猜。
什么时候用 Repair,什么时候用 OCR
- 查看器完全打不开文件 → 先试 修复 PDF。
- 文件能打开,但扫描页上的文字无法选择或搜索 → 用 OCR / 扫描清理 取 Markdown 文本;如果体积要紧,再单独压缩(扫描包工作流)。
- 需要在脚本或 Agent 里做同样的修复 → 调修复 PDF API,Key 和 OpenAPI 见开发者。重试时优先带
Idempotency-Key(Idempotency-Key)。
成功是什么样
修复后,只要还有足够多的对象留存,查看器就应该能打开文件而不报“损坏的 PDF”。结构干净恢复时,获取信息 给出的页数应与你对原件的预期一致。如果文件仍然打不开,再多的压缩 / OCR / 转换也变不出缺失的字节;此时停手,并按策略要求把原件留给本目录之外的取证工具。
试一下
在 修复 PDF 上传损坏文件,或带 API Key 调 POST /api/v1/misc/repair。任何修复产物旁边都留好损坏的原件。面向 Agent 的访问(MCP、pipeline、OpenAPI)从开发者起步。