Langkau ke kandungan utama
PPDF123

Tukar Jadual PDF kepada Excel

PDF ke Excel mencari baris jadual yang sejajar dalam teks PDF dan menulis setiap jadual ke helaiannya sendiri dalam buku kerja .xlsx. Ia memerlukan lapisan teks, dan tidak memberi apa-apa untuk prosa atau halaman imbasan.

Seret dan lepaskan fail di sini, atau klik untuk pilih

Menerima PDF · sehingga 500.0 MB setiap fail · sehingga 20 fail sekali gus

Anda juga boleh menampal fail dengan Ctrl/Cmd+V atau dari menu papan keratan.

PDF ke Excel menjalankan `pdftotext -layout`, mencari baris yang mengandungi dua atau lebih ruang berturut-turut, lalu menulis baris itu ke buku kerja `.xlsx`. Setiap jadual yang dikesan menjadi lembaran dinamakan `Page N` atau `Page N Table M`. Sesuai untuk PDF elektronik yang lajur sudah sejajar dalam teks yang diekstrak.

Satu jadual memerlukan sekurang-kurangnya dua baris berturut-turut yang kelihatan seperti jadual. Prosa, pengepala satu baris sahaja, atau imbasan tanpa lapisan teks menghasilkan `no_content`: tiada buku kerja. Hasil kosong disengajakan, bukan kegagalan senyap.

Alat ini mengabaikan parameter permintaan. Halaman ini tiada medan julat halaman. Lajur dipotong pada dua atau lebih ruang berturut-turut; ruang tunggal dalam sel kekal dalam sel.

Ini bukan OCR. Imbasan imej sahaja tiada kandungan untuk `pdftotext` baca. OCR di tapak ini memulangkan Markdown, yang tidak boleh dihantar semula ke PDF ke Excel. Apabila teks hanya wujud dalam piksel, tiada hamparan di sini.

PDF ke CSV memakai heuristik susun atur yang sama. Satu jadual menjadi satu CSV; beberapa jadual menjadi ZIP CSV. Excel meletakkan jadual itu sebagai lembaran dalam buku kerja yang sama. Kedua-duanya tidak memulihkan sel gabung, pengepala berwarna, atau lembaran tersembunyi daripada PDF.

Buka muat turun dalam Excel atau LibreOffice Calc dan sampel beberapa baris untuk semak potongan lajur. Jadual rapat tanpa jurang ruang berganda sering jatuh ke satu lajur. Fail yang dilindungi kata laluan dibuka untuk anda pada halaman ini sebaik sahaja anda memasukkan kata laluan; pemanggil API perlu menjalankan Buang kata laluan dahulu.

Peraturan dua ruang itulah seluruh mekanisme pengesanan, jadi kualiti buku kerja bergantung sepenuhnya pada cara PDF disusun huruf. Jadual daripada penjana laporan yang menambah padding setiap sel ke lebar tetap diekstrak dengan bersih. Jadual yang antara lajurnya hanya satu ruang, atau memakai fon berkadar yang menghampirkan lajur hampir bersebelahan, tidak dikenali sebagai jadual langsung dan mungkin tidak menghasilkan buku kerja. Sebelum menyalahkan alat, pilih satu baris dalam PDF dan pastikan teks itu memang boleh dipilih.

Penamaan lembaran mengikut kedudukan, bukan kandungan. Setiap blok yang dikesan menjadi `Page N` atau `Page N Table M`, mengikut urutan halaman diimbas. Laporan dengan satu jadual setiap halaman menghasilkan satu lembaran setiap halaman; halaman dengan tiga jadual bertindan menghasilkan tiga lembaran bernombor. Tiada pilihan menamakan lembaran ikut sel pengepala, dan tiada output gabungan dalam satu lembaran.

Nilai ditulis sebagai teks, sama seperti yang muncul dalam pengekstrakan yang mengekalkan susun atur. Nombor tidak ditukar kepada sel berangka, jadi sifar di hadapan kekal dan simbol mata wang serta pemisah ribuan tinggal dalam rentetan. Ini biasanya yang anda mahu untuk nombor akaun dan poskod, dan agak menyusahkan untuk lajur amaun yang mahu anda jumlahkan. Tukar jenis dalam hamparan, atau salin lajur itu dan guna teks-ke-lajur atau penukaran nilai dalam program tujuan.

Baris tidak dinyahduplikasi dan pengepala berulang tidak dibuang. Apabila jadual terputus pada sempadan halaman, baris pengepala sering berulang di halaman seterusnya dan sambungannya menjadi lembaran tersendiri. Sel gabung tidak dibina semula; sel yang merentangi dua lajur dalam PDF hanya meletakkan teksnya di lajur paling kiri dan lajur kanannya kosong. Sel berbilang baris menjadi baris berasingan, bukan satu nilai yang dilipat.

Muat naik bersifat sementara. Kami tidak menyimpan pustaka buku kerja anda.

Ciri

  • `pdftotext -layout` ditambah heuristik potong lajur ruang berganda
  • Satu lembaran setiap jadual dikesan; tiada fail jika pengesanan kosong
  • Bukan OCR; Markdown OCR tidak boleh dihantar ke sini
  • Sel berjenis teks; tiada inferens jenis atau pembinaan semula sel gabung
  • API tanpa nama: /api/v1/convert/pdf/xlsx

Bila menggunakan alat ini

  • Buka jadual yang diekstrak terus dalam Excel atau LibreOffice Calc
  • Tarik jadual invois elektronik ke buku kerja
  • Jadikan jadual merentas halaman sebagai lembaran berasingan, bukan satu CSV
  • Mengekstrak penyata kewangan lebar tetap untuk analisis lanjut

Bagaimana cara menukar jadual PDF kepada Excel?

  1. Muat naik PDF yang sudah ada teks boleh dipilih dan lajur berbentuk jadual.
  2. Klik proses. Alat ini tiada julat halaman atau pilihan OCR.
  3. Jika jadual dijumpai, muat turun `.xlsx`. Jika tidak, anda mendapat kejayaan kosong; cuba sumber dengan lapisan teks.
  4. Buka buku kerja dan semak potongan. PDF prosa sahaja tidak menghasilkan lembaran.

Had dan kes khas

  • Memerlukan teks boleh dipilih dan jurang lajur ruang berganda
  • Tiada OCR, juga tiada kawalan julat halaman
  • Sel gabung dan gaya tidak dibina semula
  • Semua nilai ialah teks; tiada penaipan nombor atau tarikh
  • Jadual yang merentasi halaman menjadi lembaran berasingan
  • Had muat naik di tapak web ini: 500 MB setiap fail, dihantar berketul-ketul melebihi kira-kira 95 MB. Satu badan permintaan API langsung dihadkan pada 100 MB.

Contoh

  • PDF teks dengan senarai harga tiga lajur sering menjadi satu lembaran dengan lajur itu
  • Penyata bank imbasan tanpa lapisan teks tidak memulangkan buku kerja
  • Laporan sepuluh halaman dengan satu jadual setiap halaman menghasilkan sepuluh lembaran bernama Page 1 hingga Page 10

Privasi untuk alat ini

Fail dimuat naik melalui HTTPS, diproses dalam memori atau direktori sementara singkat di pelayan kami, kemudian dipadam apabila hasil sedia. Kami tidak menyimpan salinan untuk semakan kemudian, latihan, atau profil iklan. Lihat Dasar Privasi untuk pengekalan dan pendedahan kuki AdSense.

Soalan lazim

Mengapa saya tidak mendapat hamparan?
Tiada blok dua baris jadual berturut-turut atau lebih dijumpai. Imbasan, prosa, dan jadual tanpa jurang ruang berganda membuat heuristik ini gagal.
Bolehkah OCR dahulu kemudian tukar ke Excel?
Tidak. OCR memulangkan Markdown. Alat ini hanya membaca PDF melalui pdftotext.
Apa beza dengan PDF ke CSV?
Pengesanan sama. Excel menulis setiap jadual ke lembaran sendiri dalam buku kerja yang sama. CSV satu fail setiap jadual (satu CSV, atau ZIP jika banyak).
Adakah setiap halaman dibaca?
Ya. pdftotext membahagi mengikut form suapan. Setiap halaman diimbas untuk blok jadual. Tiada parameter julat halaman.
Mengapa nombor saya disimpan sebagai teks?
Nilai ditulis tepat seperti diekstrak, jadi sifar di hadapan dan pemformatan kekal. Tukar lajur itu kepada berangka dalam hamparan jika perlu mengira dengannya.
Adakah sel gabung dibina semula?
Tidak. Teks sel gabung masuk ke lajur paling kiri dan lajur lain kosong. Sel berbilang baris menjadi baris berasingan, bukan satu nilai yang dilipat.
Mengapa satu jadual menghasilkan beberapa lembaran?
Jadual yang bersambung ke halaman baharu dikesan semula di sana dan menjadi lembaran lain. Baris pengepala sering berulang; alat ini tidak menggabungkan serpihannya.

Kemas kini terakhir:

Panggil dari kod

Setiap alat di laman ini ialah panggilan REST biasa. Penggunaan tanpa nama tidak perlukan akaun atau kunci API. Untuk pelayar, pembangun dan ejen AI sama-sama.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Juga tersedia sebagai alat MCP untuk klien ejen yang menggunakan Model Context Protocol (JSON-RPC 2.0 melalui POST /mcp). Rujukan API penuh

Gunakan melalui ejen AI

Skill

Dengan skill ini, Claude Code, Codex, Cursor dan ejen AI lain boleh menjalankan "PDF ke Excel" bagi pihak anda: /skills/pdf123-pdf-to-xlsx.md

Semua skill ejen

Fail hanya digunakan untuk pemprosesan ini dan dipadam secara automatik selepas itu.