Ubah Tabel PDF Menjadi Excel
PDF ke Excel menemukan baris tabel yang sejajar pada teks PDF dan menulis tiap tabel ke lembarnya sendiri dalam buku kerja .xlsx. Alat ini butuh lapisan teks dan tidak menghasilkan apa pun untuk prosa atau halaman pindaian.
Seret file ke sini, atau klik untuk memilih
Menerima PDF · maksimal 500.0 MB per file · hingga 20 file sekaligus
Anda juga dapat menempelkan file dengan Ctrl/Cmd+V atau dari menu papan klip.
PDF ke Excel menjalankan `pdftotext -layout`, mencari baris dengan dua spasi beruntun atau lebih, lalu menulis baris itu ke buku kerja `.xlsx`. Setiap tabel yang terdeteksi menjadi lembar bernama `Page N` atau `Page N Table M`. Cocok untuk PDF digital yang kolomnya sudah sejajar di teks yang diekstrak.
Satu tabel butuh setidaknya dua baris tabular berurutan. Prosa, satu baris tajuk saja, atau pindaian tanpa lapisan teks memberi `no_content`: tanpa buku kerja. Hasil kosong disengaja, bukan kegagalan diam-diam.
Alat ini mengabaikan parameter permintaan. Halaman ini tidak punya bidang rentang halaman. Kolom dipotong pada dua spasi beruntun atau lebih; spasi tunggal di dalam sel tetap di sel.
Ini bukan OCR. Pindaian hanya-gambar tidak punya konten untuk `pdftotext`. OCR situs ini mengembalikan Markdown, yang tidak bisa dikirim lagi ke PDF ke Excel. Jika kata hanya ada di piksel, di sini tidak ada spreadsheet.
PDF ke CSV memakai heuristik tata letak yang sama. Satu tabel jadi satu CSV; banyak tabel jadi ZIP berisi CSV. Excel menaruh tabel-tabel itu di lembar terpisah dalam satu buku kerja. Keduanya tidak memulihkan sel gabungan, tajuk berwarna, atau lembar tersembunyi dari PDF.
Buka unduhan di Excel atau LibreOffice Calc dan periksa beberapa baris untuk pemotongan kolom. Tabel rapat tanpa celah dua spasi sering jatuh ke satu kolom. Berkas yang dilindungi kata sandi dibuka untuk Anda di halaman ini setelah Anda memasukkan kata sandinya; pengguna API harus menjalankan Hapus kata sandi lebih dulu.
Aturan dua spasi adalah seluruh mekanisme deteksi, jadi kualitas buku kerja sepenuhnya bergantung pada cara PDF ditata. Tabel dari pembuat laporan yang memberi padding tiap sel ke lebar tetap terekstrak dengan bersih. Tabel yang antarkolomnya hanya satu spasi, atau memakai font proporsional yang membuat kolom hampir berdempetan, tidak terdeteksi sebagai tabel sama sekali dan mungkin tidak menghasilkan buku kerja. Sebelum menyalahkan alat, pilih satu baris di PDF dan pastikan teksnya memang bisa dipilih.
Penamaan lembar mengikuti posisi, bukan isi. Setiap blok yang terdeteksi menjadi `Page N` atau `Page N Table M`, sesuai urutan pemindaian halaman. Laporan dengan satu tabel per halaman menghasilkan satu lembar per halaman; halaman dengan tiga tabel bertumpuk menghasilkan tiga lembar bernomor. Tidak ada opsi menamai lembar dari sel tajuk, dan tidak ada keluaran gabungan dalam satu lembar.
Nilai ditulis sebagai teks, persis seperti muncul dalam ekstraksi yang mempertahankan tata letak. Angka tidak diubah menjadi sel numerik, sehingga nol di depan tetap ada dan simbol mata uang serta pemisah ribuan tetap di dalam string. Ini biasanya yang Anda inginkan untuk nomor rekening dan kode pos, tapi agak mengganggu untuk kolom nominal yang ingin Anda jumlahkan. Ubah tipenya di spreadsheet, atau salin kolomnya dan pakai fitur teks-ke-kolom atau konversi nilai di program tujuan.
Baris tidak dideduplikasi dan tajuk berulang tidak dihapus. Saat tabel terpotong di batas halaman, baris tajuk sering terulang di halaman berikutnya dan lanjutannya menjadi lembar tersendiri. Sel gabungan tidak direkonstruksi; sel yang membentang dua kolom di PDF sekadar menaruh teksnya di kolom paling kiri dan kolom kanannya kosong. Sel multi-baris menjadi baris terpisah, bukan satu nilai yang terlipat.
Unggahan bersifat sementara. Kami tidak menyimpan pustaka buku kerja Anda.
Fitur
- `pdftotext -layout` plus heuristik potong kolom dua spasi
- Satu lembar per tabel terdeteksi; kosong = tanpa berkas
- Bukan OCR; Markdown OCR tidak bisa dikirim ke sini
- Sel bertipe teks; tanpa inferensi tipe atau rekonstruksi sel gabungan
- API anonim: /api/v1/convert/pdf/xlsx
Kapan memakai alat ini
- Membuka tabel hasil ekstraksi langsung di Excel atau LibreOffice Calc
- Menarik tabel faktur digital ke buku kerja
- Membiarkan tabel beberapa halaman menjadi lembar sendiri, bukan satu CSV
- Mengekstrak laporan keuangan berlebar tetap untuk dianalisis lebih lanjut
Bagaimana cara mengubah tabel PDF menjadi Excel?
- Unggah PDF yang sudah punya teks yang bisa dipilih dan kolom seperti tabel.
- Klik proses. Tidak ada opsi rentang halaman atau OCR.
- Jika tabel ditemukan, unduh `.xlsx`. Jika tidak, Anda mendapat sukses kosong; coba sumber berlapisan teks.
- Buka buku kerja dan cek pemotongan. PDF prosa murni tidak menghasilkan lembar.
Batasan dan kasus khusus
- Perlu teks yang bisa dipilih dan celah kolom dua spasi
- Tanpa OCR dan tanpa kontrol rentang halaman
- Sel gabungan dan gaya tidak direkonstruksi
- Semua nilai berupa teks; tanpa pengetikan angka atau tanggal
- Tabel yang melintasi halaman menjadi lembar terpisah
- Batas unggah di situs ini: 500 MB per berkas, dikirim bertahap (per potongan) di atas sekitar 95 MB. Satu permintaan API langsung dibatasi 100 MB.
Contoh
- Laporan dengan kolom dipisah spasi lebar biasanya menghasilkan lembar Page 1
- Pindaian tanpa teks menghasilkan no_content tanpa .xlsx
- Laporan sepuluh halaman dengan satu tabel per halaman menghasilkan sepuluh lembar bernama Page 1 sampai Page 10
Privasi alat ini
File diunggah lewat HTTPS, diproses di memori atau direktori sementara singkat di server kami, lalu dihapus saat hasil siap. Kami tidak menyimpan salinan untuk ditelusuri nanti, pelatihan, atau profil iklan. Lihat Kebijakan Privasi untuk retensi dan pengungkapan cookie AdSense.
Pertanyaan umum
- Mengapa saya tidak mendapat spreadsheet?
- Tidak ditemukan blok dua baris tabular berurutan atau lebih. Pindaian, prosa, dan tabel tanpa celah dua spasi membuat heuristik gagal.
- Bisakah OCR dulu lalu konversi ke Excel?
- Tidak. OCR mengembalikan Markdown. Alat ini hanya membaca PDF lewat pdftotext.
- Apa bedanya dengan PDF ke CSV?
- Deteksi sama. Excel menulis tiap tabel ke lembar sendiri dalam satu buku kerja. CSV satu berkas per tabel (satu CSV, atau ZIP jika banyak).
- Apakah setiap halaman dibaca?
- Ya. pdftotext membagi halaman pada form feed. Tiap halaman dipindai untuk blok tabel. Tidak ada parameter rentang halaman.
- Mengapa angka saya disimpan sebagai teks?
- Nilai ditulis persis seperti diekstrak, jadi nol di depan dan format tetap terjaga. Ubah kolomnya menjadi numerik di spreadsheet jika perlu menghitung.
- Apakah sel gabungan direkonstruksi?
- Tidak. Teks sel gabungan masuk ke kolom paling kiri dan kolom lain kosong. Sel multi-baris menjadi baris terpisah, bukan satu nilai yang terlipat.
- Mengapa satu tabel menghasilkan beberapa lembar?
- Tabel yang berlanjut ke halaman baru terdeteksi lagi di sana dan menjadi lembar lain. Baris tajuk sering terulang; alat ini tidak menggabungkan pecahannya.
Terakhir diperbarui:
Panggil dari kode
Setiap alat di situs ini adalah antarmuka REST biasa. Pemakaian anonim tidak butuh akun atau kunci API. Bisa dipakai dari browser, oleh pengembang, maupun agen AI.
curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
-F "[email protected]" \
-o output.pdfJuga tersedia sebagai alat MCP untuk klien agen yang memakai Model Context Protocol (JSON-RPC 2.0 lewat POST /mcp). Referensi API lengkap
Gunakan dari agen AI
SkillDengan skill ini, Claude Code, Codex, Cursor, dan agen AI lainnya bisa menjalankan "PDF ke Excel" untuk Anda: /skills/pdf123-pdf-to-xlsx.md
File hanya dipakai untuk pemrosesan ini, lalu dihapus otomatis.