Tách PDF theo chương
Tách theo chương cắt PDF tại các dấu trang cấp cao nhất và trả về mỗi chương một PDF trong ZIP. Tệp không có dấu trang bị từ chối, vì công cụ đọc dàn ý chứ không đọc chữ trên trang.
Kéo tệp vào đây, hoặc nhấp để chọn
Nhận PDF · tối đa 500.0 MB mỗi tệp · tối đa 20 tệp mỗi lần
Bạn cũng có thể dán tệp bằng Ctrl/Cmd+V hoặc từ menu clipboard.
Tách theo chương đi theo tầng đỉnh của dàn ý PDF (`/Outlines` First/Next), cắt bằng qpdf thành ZIP các PDF chương. Không OCR tiêu đề, cũng không phân tích chữ tiêu đề trên trang.
`allowDuplicates` có hiệu lực. `bookmarkLevel` trên biểu mẫu bị bỏ qua. Chỉ dùng tầng đỉnh dàn ý. Tệp không có dàn ý trả BadRequest, và các trang trước dấu trang đầu tiên không thuộc chương nào.
ZIP tên `{base}_split.zip` và chứa các tệp `{base}_chapter_N.pdf`. Tệp có mật khẩu được mở khóa giúp bạn ngay trên trang này khi bạn nhập mật khẩu; người gọi API chạy Gỡ mật khẩu trước.
Không có dấu trang thì dùng Tách PDF (cắt theo trang) hoặc Tách theo dung lượng hoặc số trang (khối theo số trang).
Tải lên là tạm thời. Chúng tôi không lưu thư viện PDF của bạn.
Tính năng
- Chỉ `/Outlines` tầng đỉnh; qpdf cắt thành ZIP
- `bookmarkLevel` bỏ qua; PDF không dàn ý báo lỗi
- Không OCR, cũng không phát hiện chữ tiêu đề
- API ẩn danh: /api/v1/general/split-pdf-by-chapters
Khi nào nên dùng
- Cắt sách đã có dàn ý chuẩn thành tệp chương
- Tách báo cáo mà dấu trang khớp chương thật
- Tránh đoán điểm đầu chương từ chữ tiêu đề
Làm thế nào để tách PDF theo chương?
- Tải lên PDF đã có bảng dàn ý/dấu trang.
- Nhấp Bắt đầu xử lý. bookmarkLevel không đổi điểm cắt.
- Tải `{name}_split.zip`.
- Giải nén rồi kiểm điểm đầu chương theo dàn ý, không theo tiêu đề in.
Giới hạn và ngoại lệ
- Cần /Outlines
- Chỉ tầng đỉnh
- Không phải OCR
- Giới hạn tải lên trên trang web này: 500 MB mỗi tệp, tệp lớn hơn khoảng 95 MB được gửi theo từng phần. Một yêu cầu API trực tiếp bị giới hạn ở 100 MB.
Ví dụ
- Sách 10 chương, 10 dấu trang tầng đỉnh, ZIP khoảng 10 PDF
- PDF có tiêu đề in nhưng bảng dàn ý trống sẽ báo lỗi
Quyền riêng tư của công cụ này
Tệp được tải lên qua HTTPS, xử lý trong bộ nhớ hoặc thư mục tạm ngắn hạn trên máy chủ của chúng tôi, rồi bị xóa khi kết quả sẵn sàng. Chúng tôi không giữ bản sao để duyệt sau, huấn luyện hay lập hồ sơ quảng cáo. Thời hạn lưu giữ và thông báo cookie AdSense nằm trong Chính sách quyền riêng tư.
Câu hỏi thường gặp
- Tiêu đề nhìn rõ, vì sao thất bại?
- Thao tác đọc từ điển dàn ý, không phải chữ trên trang. Hãy thêm dấu trang trước, hoặc đổi công cụ tách khác.
- Tách theo tiêu đề cấp 2 được không?
- Không. bookmarkLevel vô dụng. Chỉ các nút anh em tầng đỉnh là điểm cắt.
- Có giống Tách PDF không?
- Không. Tách PDF dùng số trang bạn gõ. Ở đây dùng đích dàn ý.
- allowDuplicates làm gì?
- Khi tắt, chương mà dấu trang kế tiếp trỏ cùng một trang sẽ bị bỏ qua. Khi bật, chương đó thành một PDF trống.
Cập nhật lần cuối:
Gọi bằng mã
Mỗi công cụ trên trang là một API REST thông thường. Dùng ẩn danh không cần tài khoản hay API key. Trình duyệt, lập trình viên và agent đều gọi được.
curl -X POST "https://pdf123.xyz/api/v1/general/split-pdf-by-chapters" \
-F "[email protected]" \
-o output.pdfCũng có dạng công cụ MCP cho client dùng Model Context Protocol (JSON-RPC 2.0, POST /mcp). Tài liệu API đầy đủ
Dùng từ AI agent
SkillVới skill này, Claude Code, Codex, Cursor và các AI agent khác có thể chạy "Tách theo chương" thay bạn: /skills/pdf123-split-by-chapters.md
Tệp chỉ dùng cho lần xử lý này, xong là tự xóa.