Ana içeriğe geç
PPDF123

PDF Tablolarını Excel'e Dönüştürün

PDF'den Excel'e, PDF metnindeki hizalı tablo satırlarını bulur ve her tabloyu bir .xlsx çalışma kitabının ayrı sayfasına yazar. Metin katmanı gerekir; düzyazı ya da taranmış sayfalarda hiçbir şey döndürmez.

Dosyaları buraya sürükleyip bırakın veya seçmek için tıklayın

PDF kabul edilir · dosya başına en fazla 500.0 MB · bir seferde en fazla 20 dosya

Bir dosyayı Ctrl/Cmd+V ile veya pano menüsünden de yapıştırabilirsiniz.

PDF'den Excel'e, `pdftotext -layout` çalıştırır; ardışık iki veya daha fazla boşluk içeren satırları arar ve o satırları `.xlsx` çalışma kitabına yazar. Algılanan her tablo `Page N` veya `Page N Table M` adlı çalışma sayfası olur. Çıkarılan metinde sütunları zaten hizalı elektronik PDF'ler içindir.

Bir tabloda en az iki ardışık satır tablo gibi olmalıdır. Nesir, tek satır başlık veya metin katmanı olmayan taramalar `no_content` verir: çalışma kitabı yok. Boş sonuç kasıtlıdır; sessiz başarısızlık değildir.

Bu araç istek parametrelerini yok sayar. Bu sayfada sayfa aralığı alanı yoktur. Sütunlar ardışık iki veya daha fazla boşlukla kesilir; hücre içi tek boşluk hücrede kalır.

OCR değildir. Salt görüntü taramalarda `pdftotext`'in okuyacağı içerik yoktur. Bu sitede OCR Markdown döner ve yeniden PDF'den Excel'e verilemez. Yazı yalnızca piksellerdeyse burada elektronik tablo çıkmaz.

PDF'den CSV'ye aynı düzen sezgisini kullanır. Tek tablo bir CSV; birden fazla tablo CSV ZIP'i olur. Excel o tabloları aynı çalışma kitabının sayfalarına koyar. İkisi de PDF'den birleşik hücre, renkli başlık veya gizli sayfa geri getirmez.

İndirmeyi Excel veya LibreOffice Calc ile açıp birkaç satırda sütun kesimini denetleyin. Çift boşluk aralığı olmayan sıkı tablolar çoğu zaman tek sütuna düşer. Parola korumalı dosyaların kilidi, parolayı girdiğinizde bu sayfada sizin için açılır; API çağıranları önce Parolayı kaldır çalıştırır.

İki boşluk kuralı tüm algılama mekanizmasıdır, dolayısıyla çalışma kitabının kalitesi tamamen PDF'in nasıl dizildiğine bağlıdır. Her hücreyi sabit genişliğe dolgu yapan rapor üreticilerinden çıkan tablolar temiz çıkarılır. Sütunlar arasında yalnızca bir boşluk olan veya sütunları neredeyse bitişik koyan orantılı yazı tipleriyle dizilmiş tablolar hiç tablo olarak algılanmaz ve çalışma kitabı vermeyebilir. Aracı suçlamadan önce PDF'te bir satır seçin ve metnin gerçekten seçilebilir olduğunu doğrulayın.

Sayfa adları içeriği değil konumu izler. Algılanan her blok, sayfaların taranma sırasına göre `Page N` veya `Page N Table M` olur. Her sayfada bir tablosu olan bir rapor sayfa başına bir sayfa verir; üst üste üç tablo bulunan bir sayfa üç numaralı sayfa üretir. Sayfaları başlık hücresine göre adlandırma seçeneği ve tek sayfada birleşik çıktı yoktur.

Değerler, düzeni koruyan çıkarımda göründükleri gibi metin olarak yazılır. Sayılar sayısal hücrelere dönüştürülmez; bu yüzden baştaki sıfırlar korunur, para birimi simgeleri ve binlik ayırıcılar dizede kalır. Hesap numaraları ve posta kodları için genellikle istediğiniz budur; toplamayı düşündüğünüz tutar sütununda ise biraz can sıkıcıdır. Türleri elektronik tabloda dönüştürün ya da sütunu kopyalayıp hedef programın metni sütunlara böl veya değer dönüştürme özelliğini kullanın.

Satırlar tekilleştirilmez ve yinelenen başlıklar kaldırılmaz. Bir tablo sayfa sınırında bölünürse başlık satırı sıklıkla sonraki sayfada yinelenir ve devamı kendi sayfası olur. Birleşik hücreler yeniden oluşturulmaz; PDF'te iki sütuna yayılan bir hücrenin metni yalnızca en soldaki sütuna gelir, sağdaki sütun boş kalır. Çok satırlı hücreler kaydırılmış tek bir değer yerine ayrı satırlar olur.

Yüklemeler geçicidir. Çalışma kitabı arşivinizi tutmayız.

Özellikler

  • `pdftotext -layout` artı çift boşluk sütun sezgisi
  • Algılanan tablo başına bir çalışma sayfası; algı boşsa dosya dönmez
  • OCR değildir; OCR Markdown'ı buraya verilemez
  • Metin türünde hücreler; tür çıkarımı veya birleşik hücre yeniden oluşturma yok
  • Anonim API: /api/v1/convert/pdf/xlsx

Bu araç ne zaman kullanılır

  • Çıkarılan tabloları doğrudan Excel veya LibreOffice Calc'ta açmak
  • Elektronik fatura tablosunu çalışma kitabına çekmek
  • Çok sayfadaki tabloları CSV yerine çalışma sayfası yapmak
  • Daha ileri analiz için sabit genişlikte bir mali tablo çıkarmak

PDF tablosunu Excel'e nasıl dönüştürürüm?

  1. Seçilebilir metni olan ve tablo gibi sütunlanmış PDF yükleyin.
  2. İşle'ye tıklayın. Bu araçta sayfa aralığı veya OCR seçeneği yoktur.
  3. Tablo bulunduysa `.xlsx` indirin. Yoksa boş başarı alırsınız; metin katmanlı kaynak deneyin.
  4. Çalışma kitabını açıp kesimi denetleyin. Salt nesir PDF çalışma sayfası üretmez.

Sınırlar ve özel durumlar

  • Seçilebilir metin ve çift boşluk sütun aralığı gerekir
  • OCR veya sayfa aralığı denetimi yok
  • Birleşik hücreler ve stil yeniden oluşturulmaz
  • Tüm değerler metin; sayı veya tarih türü yok
  • Sayfalar arası tablolar ayrı sayfalara dönüşür
  • Bu sitedeki yükleme sınırı: dosya başına 500 MB; yaklaşık 95 MB üzerindeki dosyalar parçalar hâlinde gönderilir. Doğrudan tek bir API isteğinin gövdesi 100 MB ile sınırlıdır.

Örnekler

  • Üç sütunlu fiyat listeli metin PDF çoğu zaman o sütunların bir çalışma sayfası olur
  • Metin katmanı olmayan taranmış banka ekstresi çalışma kitabı döndürmez
  • Her sayfada bir tablo bulunan on sayfalık bir rapor Page 1'den Page 10'a kadar on sayfa verir

Bu araç için gizlilik

Dosyalar HTTPS üzerinden yüklenir, bellekte veya sunucularımızdaki kısa ömürlü geçici bir dizinde işlenir ve sonucunuz hazır olduğunda silinir. Daha sonra gezinme, eğitim veya reklam profilleri için kopya tutmayız. Saklama ayrıntıları ve AdSense çerez bildirimleri için Gizlilik Politikası'na bakın.

Sık sorulan sorular

Neden elektronik tablo alamadım?
Ardışık iki veya daha fazla tablo satırından oluşan bir blok bulunamadı. Taramalar, nesir ve çift boşluk aralığı olmayan tablolar bu sezgiyi düşürür.
Önce OCR yapıp sonra Excel'e dönüştürebilir miyim?
Hayır. OCR Markdown döner. Bu araç PDF'yi yalnızca pdftotext ile okur.
PDF'den CSV'ye farkı ne?
Algılama aynıdır. Excel her tabloyu aynı çalışma kitabının ayrı sayfasına yazar. CSV tablo başına bir dosyadır (tek CSV veya ZIP).
Her sayfa okunur mu?
Evet. pdftotext sayfa sonlarıyla böler. Her sayfada tablo blokları taranır. Sayfa aralığı parametresi yoktur.
Sayılarım neden metin olarak saklanıyor?
Değerler çıkarıldığı gibi yazılır; baştaki sıfırlar ve biçimlendirme korunur. Hesaplama yapacaksanız sütunu elektronik tabloda sayısala dönüştürün.
Birleşik hücreler yeniden oluşturulur mu?
Hayır. Birleşik hücrenin metni en soldaki sütuna gelir, diğer sütunlar boş kalır. Çok satırlı hücreler kaydırılmış tek bir değer yerine ayrı satırlar olur.
Neden tek tablo için birkaç sayfam var?
Yeni sayfada devam eden tablo orada yeniden algılanır ve bir sayfa daha olur. Başlık satırları sıklıkla yinelenir; araç parçaları birleştirmez.

Son güncelleme:

Koddan çağırın

Bu sitedeki her araç düz bir REST arayüzüdür. Anonim kullanım için hesap veya API anahtarı gerekmez. Tarayıcı, geliştirici ve yapay zeka ajanları için aynı şekilde kullanılabilir.

curl -X POST "https://pdf123.xyz/api/v1/convert/pdf/xlsx" \
  -F "[email protected]" \
  -o output.pdf

Model Context Protocol konuşan ajan istemcileri için MCP aracı olarak da kullanılabilir (JSON-RPC 2.0, POST /mcp). Tam API belgesi

Bir yapay zekâ ajanıyla kullanın

Beceri

Bu beceriyle Claude Code, Codex, Cursor ve diğer yapay zekâ ajanları sizin için "PDF'den Excel'e" işlemini yapabilir: /skills/pdf123-pdf-to-xlsx.md

Tüm ajan becerileri

Dosyalar yalnızca bu işlem için kullanılır ve ardından otomatik silinir.