ParseJet

PDF ke Excel — Ekstrak Tabel dari PDF

Upload PDF dan unduh buku kerja Excel dengan tabelnya. ParseJet mendeteksi tabel di setiap halaman, mempertahankan baris dan kolom utuh, mengubah angka menjadi angka nyata, dan menempatkan setiap tabel di sheet-nya sendiri. Bekerja pada faktur, laporan bank, laporan dan ekspor data; PDF yang dipindai memerlukan alat PDF OCR terlebih dahulu.

Lepas berkas di sini atau jelajahi

Menerima file PDF

Gratis — 3 permintaan/hari, tanpa pendaftaran. untuk 300 kredit/bulan gratis.

Berkas dikonversi di server ParseJet dan dihapus segera setelah respons.

Cara kerjanya

1

Upload PDF Anda

Lepaskan PDF yang berisi tabel — faktur, pernyataan, daftar harga, laporan.

2

Tabel terdeteksi

ParseJet menemukan setiap tabel dari struktur kolom dan garisnya, membaca sel dan mengetik angka.

3

Unduh .xlsx

Satu sheet per tabel, dinamai menurut halaman. Buka di Excel, Google Sheets atau Numbers — atau dapatkan CSV sebagai gantinya melalui API.

Fitur utama

Apa yang membuat pdf to excel ini menonjol.

Semua tabel, setiap halaman

Dokumen multi-halaman ditangani sekaligus; setiap tabel mendapat sheet tersendiri bernama menurut halamannya.

Angka nyata, bukan teks

1.250,00 menjadi 1250 sehingga total, pengurutan dan rumus bekerja segera.

Header disimpan

Baris pertama setiap tabel ditulis tebal dan lebar kolom disesuaikan dengan konten.

CSV saat Anda menginginkannya

Konversi yang sama mengembalikan CSV untuk skrip dan impor — minta output_format=csv di API.

Tanpa watermark, tanpa email

Unduh file sekaligus. Tidak ada yang ditambahkan ke dalamnya dan tidak ada yang disimpan di pihak kami.

Batch melalui API

Konversi ratusan pernyataan dengan beberapa baris Python atau JavaScript.

Kasus penggunaan

Skenario umum di mana alat ini menghemat waktu Anda.

Laporan bank dan kartu

Dapatkan transaksi ke spreadsheet untuk penganggaran, rekonsiliasi atau saat pajak.

Faktur dan daftar harga

Item baris dan harga mendarat di sel yang dapat Anda jumlahkan dan bandingkan.

Laporan dan penelitian

Angkat tabel data keluar dari laporan PDF untuk membuat grafik atau menganalisisnya.

Pipeline data

Ekstrak tabel dari PDF masuk secara otomatis dan muat ke database.

Otomatisasi dengan API

Gunakan alat yang sama secara terprogram. Bekerja dengan bahasa apa pun — cukup HTTP.

cURL
# PDF tables → Excel workbook (one sheet per table)
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=xlsx" \
  -o statement.xlsx

# ... or CSV
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=csv" -o statement.csv
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/convert/document",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"files": open("statement.pdf", "rb")},
    data={"output_format": "xlsx"},
    timeout=120,
)
resp.raise_for_status()
open("statement.xlsx", "wb").write(resp.content)
print(resp.headers["x-tables"], "tables")
JavaScript
const formData = new FormData();
formData.append("files", pdfFile);
formData.append("output_format", "xlsx");

const res = await fetch("https://api.parsejet.com/v1/convert/document", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const blob = await res.blob(); // the .xlsx file
console.log(res.headers.get("x-tables"), "tables");

Ingin mengotomatiskan ini?

ParseJet API memberikan kemampuan parsing yang sama melalui satu endpoint HTTP. Tanpa ffmpeg, tanpa poppler, tanpa tesseract — cukup satu panggilan API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Baca Dokumentasi API

Pertanyaan yang sering diajukan

Bagaimana cara mengonversi PDF ke Excel?

Unggah PDF di atas dan klik Konversi. Anda mendapatkan file .xlsx dengan satu sheet per tabel yang ditemukan dalam dokumen. Tiga konversi per hari gratis tanpa akun.

Apakah ini bekerja dengan PDF yang dipindai?

Deteksi tabel memerlukan lapisan teks. Jika PDF Anda adalah pemindaian atau foto, jalankan melalui alat PDF OCR terlebih dahulu; struktur tabel kemudian harus terlihat sebagai garis yang diberi aturan atau kolom sejajar agar deteksi menangkapnya.

Mengapa dikatakan tidak ada tabel yang ditemukan?

PDF tidak memiliki lapisan teks (pemindaian) atau datanya disusun sebagai teks bebas daripada grid. Coba PDF OCR untuk pemindaian; untuk dokumen hanya-teks, alat PDF ke Teks memberi Anda konten untuk membentuk ulang dengan tangan.

Akan angka menjadi angka di Excel?

Ya. Sel yang terlihat seperti angka — termasuk 1.250,00 dan -3,5 — ditulis sebagai nilai numerik sehingga Anda dapat menjumlahkan dan mengurutkan. Teks, tanggal, dan sel campuran tetap sebagai teks.

Bisakah saya mendapatkan CSV sebagai gantinya?

Ya. Melalui API, atur output_format=csv; semua tabel ditulis satu demi satu dengan baris kosong di antara mereka.

Apakah gratis?

Ya. Tiga konversi gratis per hari tanpa pendaftaran; konversi biaya 2 kredit dan paket gratis mencakup 300 kredit per bulan. Paket berbayar dimulai dari $19/bulan.

Mulai ekstraksi teks secara gratis

Tidak perlu mendaftar. Parse file pertama Anda dalam hitungan detik.

Lihat Harga