ParseJet

PDF na Excel — wyodrębnij tabele z PDF

Prześlij PDF i pobierz skoroszyt Excela z jego tabelami. ParseJet wykrywa tabele na każdej stronie, zachowuje wiersze i kolumny, zamienia liczby na rzeczywiste wartości liczbowe i umieszcza każdą tabelę w oddzielnym arkuszu. Działa na fakturach, wyciągach bankowych, raportach i eksportach danych; zeskanowane pliki PDF wymagają najpierw narzędzia PDF OCR.

Upuść plik tutaj lub przeglądaj

Akceptuje pliki PDF

Darmowe — 3 żądania/dzień, bez rejestracji. za 300 kredytów/miesiąc za darmo.

Pliki są konwertowane na serwerach ParseJet i usuwane zaraz po odpowiedzi.

Jak to działa

1

prześlij swój plik PDF

Upuść PDF, który zawiera tabele — faktury, wyciągi, cenniki, raporty.

2

tabele są wykrywane

ParseJet znajduje każdą tabelę po jej strukturze kolumn i linii, odczytuje komórki i typuje liczby.

3

pobierz plik .xlsx

Jeden arkusz na tabelę, nazwany według strony. Otwórz go w Excelu, Google Sheets lub Numbers — lub pobierz CSV zamiast tego przez API.

Kluczowe funkcje

Co wyróżnia to pdf to excel.

wszystkie tabele, każda strona

Dokumenty wielostronicowe są obsługiwane za jednym razem; każda tabela otrzymuje własny arkusz nazwany według jej strony.

rzeczywiste liczby, nie tekst

1,250.00 staje się 1250, dzięki czemu sumy, sortowanie i formuły działają natychmiast.

nagłówki zachowane

Pierwszy wiersz każdej tabeli jest napisany pogrubiony, a szerokości kolumn są dopasowane do zawartości.

CSV, gdy chcesz

Ta sama konwersja zwraca CSV dla skryptów i importów — poproś output_format=csv w API.

bez znaku wodnego, bez wiadomości

Pobierz plik natychmiast. Nic nie jest dodawane i nic nie jest przechowywane po naszej stronie.

partia przez API

Konwertuj setki wyciągów za pomocą kilku linijek Pythona lub JavaScriptu.

Przykłady zastosowań

Typowe scenariusze, w których to narzędzie oszczędza czas.

wyciągi bankowe i kartowe

Uzyskaj transakcje w arkuszu kalkulacyjnym do budżetowania, uzgadniania lub czasu podatków.

faktury i cenniki

Pozycje i ceny lądują w komórkach, które możesz sumować i porównywać.

raporty i badania

Wyodrębnij tabele danych z raportu PDF do wykresu lub analizy.

potoki danych

Automatycznie wyodrębnij tabele z przychodzących plików PDF i załaduj je do bazy danych.

Automatyzuj za pomocą API

Użyj tego samego narzędzia programistycznie. Działa z dowolnym językiem — wystarczy HTTP.

cURL
# PDF tables → Excel workbook (one sheet per table)
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=xlsx" \
  -o statement.xlsx

# ... or CSV
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=csv" -o statement.csv
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/convert/document",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"files": open("statement.pdf", "rb")},
    data={"output_format": "xlsx"},
    timeout=120,
)
resp.raise_for_status()
open("statement.xlsx", "wb").write(resp.content)
print(resp.headers["x-tables"], "tables")
JavaScript
const formData = new FormData();
formData.append("files", pdfFile);
formData.append("output_format", "xlsx");

const res = await fetch("https://api.parsejet.com/v1/convert/document", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const blob = await res.blob(); // the .xlsx file
console.log(res.headers.get("x-tables"), "tables");

Chcesz to zautomatyzować?

ParseJet API daje Ci tę samą moc parsowania przez jeden punkt końcowy HTTP. Bez ffmpeg, bez poppler, bez tesseract — tylko jedno wywołanie API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Przeczytaj dokumentację API

Często zadawane pytania

Jak konwertuje plik PDF na Excel?

Prześlij PDF powyżej i kliknij Konwertuj. Otrzymujesz plik .xlsx z jednym arkuszem na tabelę znalezioną w dokumencie. Trzy konwersje dziennie są darmowe bez konta.

Czy działa ze skanowanymi plikami PDF?

Wykrywanie tabel wymaga warstwy tekstu. Jeśli Twój PDF jest skanem lub zdjęciem, uruchom go najpierw za pośrednictwem narzędzia PDF OCR; struktura tabeli musi być wówczas widoczna jako linie lub wyrównane kolumny dla wykrycia.

Dlaczego powiedziano, że nie znaleziono tabel?

PDF nie ma warstwy tekstu (skan) lub jego dane są ułożone jako wolny tekst, a nie siatka. Spróbuj PDF OCR dla skanów; dla dokumentów tylko tekstowych narzędzie PDF to Text daje zawartość do zmian ręcznych.

Czy liczby będą liczbami w Excelu?

Tak. Komórki, które wyglądają jak liczby — łącznie z 1,250.00 i -3.5 — są zapisywane jako wartości numeryczne, dzięki czemu możesz sumować i sortować. Tekst, daty i mieszane komórki pozostają jako tekst.

Czy mogę otrzymać CSV zamiast tego?

Tak. Przez API ustaw output_format=csv; wszystkie tabele są napisane jedna po drugiej z pustą linią między nimi.

Czy to jest darmowe?

Tak. Trzy darmowe konwersje dziennie bez rejestracji; konwersja kosztuje 2 punkty, a darmowe konto zawiera 300 punktów miesięcznie. Plany płatne zaczynają się od 19 zł/miesiąc.

Zacznij bezpłatnie wyodrębniać tekst

Bez rejestracji. Przeanalizuj swój pierwszy plik w kilka sekund.

Zobacz cennik