Chuyển PDF sang Markdown
PDF sang Markdown biến phần chữ sẵn có của PDF thành tệp .md, có tiêu đề, đoạn văn và danh sách ở những chỗ nhận ra được. Công cụ không OCR, nên trang quét sẽ ra trống.
Kéo tệp vào đây, hoặc nhấp để chọn
Nhận PDF · tối đa 500.0 MB mỗi tệp · tối đa 20 tệp mỗi lần
Bạn cũng có thể dán tệp bằng Ctrl/Cmd+V hoặc từ menu clipboard.
PDF sang Markdown dùng pdf-inspector đọc chữ đã có trong tệp và trả về bản tải `.md` (`text/markdown`). Mục tiêu là tiêu đề, đoạn và danh sách — không phải bố cục từng pixel.
Không làm OCR. Trang thuần ảnh thường trống. Bản quét hãy dùng OCR sang Markdown; công cụ đó nhìn pixel và cũng ra `.md`.
Thứ tự đọc có thể không khớp bố cục nhiều cột. Đầu trang có thể lặp mỗi trang — hãy xóa trong trình soạn thảo. Công thức dạng ảnh trong PDF không thành LaTeX. Khối mã thường mất thụt lề.
Đây là bộ chuyển cho docs-as-code, diff Git và pipeline cần văn bản. Khi bố cục in mới là bản ghi, hãy giữ PDF. Chữ trích ra vẫn chịu bản quyền; chỉ chuyển tệp bạn có quyền phát hành lại dưới dạng văn bản.
Tệp có mật khẩu được mở khóa giúp bạn ngay trên trang này khi bạn nhập mật khẩu; người gọi API chạy Gỡ mật khẩu trước. Mở Markdown, sửa cấp tiêu đề trước khi commit. Markdown sang PDF trên trang là chiều ngược; một vòng đi-về không khôi phục bố cục gốc.
Tải lên là tạm thời. Chúng tôi không lưu thư viện Markdown của bạn.
Tính năng
- Trích chữ gốc PDF thành Markdown bằng pdf-inspector
- Không OCR; bản quét dùng công cụ OCR
- Tải về `text/markdown`, tên tệp `.md`
- API ẩn danh: /api/v1/convert/pdf/markdown
Khi nào nên dùng
- Đưa README PDF vào kho Git
- Đưa thân bài vào pipeline nhắc lệnh
- Soạn copy web từ bản tin PDF
Làm thế nào để chuyển PDF sang Markdown?
- Ưu tiên PDF có chữ. Bản quét hãy dùng OCR sang Markdown.
- Tải lên PDF, nhấp Bắt đầu xử lý.
- Tải tệp `.md`.
- Trong trình soạn thảo, sửa cấp tiêu đề, đầu trang lặp và bảng.
Giới hạn và ngoại lệ
- Không OCR; trang thuần ảnh gần như không trích được
- Độ trung thực bố cục có hạn
- Bảng phức tạp có thể phải chỉnh tay
- Giới hạn tải lên trên trang web này: 500 MB mỗi tệp, tệp lớn hơn khoảng 95 MB được gửi theo từng phần. Một yêu cầu API trực tiếp bị giới hạn ở 100 MB.
Ví dụ
- Sách trắng chữ thành tệp .md có đoạn và tiêu đề
- Bản quét chưa OCR gần như không cho Markdown dùng được
Quyền riêng tư của công cụ này
Tệp được tải lên qua HTTPS, xử lý trong bộ nhớ hoặc thư mục tạm ngắn hạn trên máy chủ của chúng tôi, rồi bị xóa khi kết quả sẵn sàng. Chúng tôi không giữ bản sao để duyệt sau, huấn luyện hay lập hồ sơ quảng cáo. Thời hạn lưu giữ và thông báo cookie AdSense nằm trong Chính sách quyền riêng tư.
Câu hỏi thường gặp
- Vì sao Markdown trống?
- PDF này gần như không có lớp chữ. Bản quét hãy dùng OCR sang Markdown. Công cụ này chỉ đọc chữ đã có trong tệp.
- Có giống OCR không?
- Không. OCR nhìn trang ảnh. PDF sang Markdown dùng pdf-inspector đọc chữ gốc.
- Có giữ phông không?
- Markdown là chữ cộng cấu trúc nhẹ. Phông đến từ lớp render Markdown sau đó.
- Có chuyển Markdown lại thành PDF không?
- Có, qua Markdown sang PDF. Bố cục không khớp PDF gốc.
Cập nhật lần cuối:
Gọi bằng mã
Mỗi công cụ trên trang là một API REST thông thường. Dùng ẩn danh không cần tài khoản hay API key. Trình duyệt, lập trình viên và agent đều gọi được.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/markdown" \
-F "[email protected]" \
-o output.pdfCũng có dạng công cụ MCP cho client dùng Model Context Protocol (JSON-RPC 2.0, POST /mcp). Tài liệu API đầy đủ
Dùng từ AI agent
SkillVới skill này, Claude Code, Codex, Cursor và các AI agent khác có thể chạy "PDF sang Markdown" thay bạn: /skills/pdf123-pdf-to-markdown.md
Tệp chỉ dùng cho lần xử lý này, xong là tự xóa.