ParseJet

PDF в Excel — Извлекайте таблицы из PDF

Загрузите PDF и скачайте Excel с его таблицами. ParseJet обнаруживает таблицы на каждой странице, сохраняет строки и столбцы, преобразует цифры в настоящие числа и размещает каждую таблицу на отдельном листе. Работает с счётами, выписками, отчётами и экспортами данных; сканированные PDF нужно сначала обработать инструментом PDF OCR.

Перетащите файл сюда или загрузите

Принимает файлы PDF

Бесплатно — 3 запроса/день, без регистрации. для 300 кредитов/месяц бесплатно.

Файлы конвертируются на серверах ParseJet и удаляются сразу после ответа.

Как это работает

1

Загрузите PDF

Перетащите PDF, содержащий таблицы — счета, выписки, прайс-листы, отчёты.

2

Таблицы обнаруживаются

ParseJet находит каждую таблицу по её структуре столбцов и линиям, читает ячейки и преобразует числа.

3

Скачайте .xlsx

Один лист на таблицу, названный по странице. Откройте в Excel, Google Sheets или Numbers — или получите CSV через API.

Ключевые особенности

Что отличает этот pdf to excel.

Все таблицы, все страницы

Многостраничные документы обрабатываются за раз; каждая таблица получает свой лист с названием страницы.

Настоящие числа, не текст

1 250,00 становится 1250, поэтому суммы, сортировка и формулы работают сразу.

Заголовки сохраняются

Первая строка каждой таблицы пишется полужирным, ширины столбцов подгоняются к содержимому.

CSV, когда нужен

Тот же конвертер возвращает CSV для скриптов и импорта — запросите output_format=csv в API.

Без водяного знака, без почты

Скачайте файл сразу. Ничего не добавляется, ничего не остаётся на наших серверах.

Пакетная обработка через API

Конвертируйте сотни выписок несколькими строками Python или JavaScript.

Примеры использования

Типичные сценарии, где этот инструмент экономит ваше время.

Банковские и карточные выписки

Загрузите транзакции в таблицу для бюджетирования, сверки или налогов.

Счета и прайс-листы

Позиции и цены попадают в ячейки, которые можно суммировать и сравнивать.

Отчёты и исследования

Извлеките таблицы данных из PDF-отчёта для построения диаграмм или анализа.

Конвейеры данных

Автоматически извлекайте таблицы из входящих PDF и загружайте их в базу данных.

Автоматизируйте с помощью API

Используйте тот же инструмент программно. Работает с любым языком — только HTTP.

cURL
# PDF tables → Excel workbook (one sheet per table)
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=xlsx" \
  -o statement.xlsx

# ... or CSV
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=csv" -o statement.csv
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/convert/document",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"files": open("statement.pdf", "rb")},
    data={"output_format": "xlsx"},
    timeout=120,
)
resp.raise_for_status()
open("statement.xlsx", "wb").write(resp.content)
print(resp.headers["x-tables"], "tables")
JavaScript
const formData = new FormData();
formData.append("files", pdfFile);
formData.append("output_format", "xlsx");

const res = await fetch("https://api.parsejet.com/v1/convert/document", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const blob = await res.blob(); // the .xlsx file
console.log(res.headers.get("x-tables"), "tables");

Хотите автоматизировать это?

ParseJet API предоставляет те же возможности парсинга через один HTTP-эндпоинт. Никакого ffmpeg, poppler или tesseract — всего один вызов API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Читать документацию API

Часто задаваемые вопросы

Как мне конвертировать PDF в Excel?

Загрузите PDF выше и нажмите «Конвертировать». Вы получите файл .xlsx с одним листом на таблицу из документа. Три конвертирования в день бесплатны без аккаунта.

Работает ли это со сканированными PDF?

Обнаружение таблиц требует текстовый слой. Если ваш PDF — сканирование или фото, сначала обработайте его инструментом PDF OCR; структура таблицы должна быть видна как линии или выровненные столбцы.

Почему сказано, что таблиц не найдено?

PDF либо не имеет текстового слоя (сканирование), либо его данные разложены как свободный текст, а не сетка. Попробуйте PDF OCR для сканов; для текстовых документов инструмент PDF to Text даст вам содержимое для переделки вручную.

Будут ли числа числами в Excel?

Да. Ячейки, похожие на числа — включая 1 250,00 и -3,5 — записываются как числовые значения, чтобы можно было суммировать и сортировать. Текст, даты и смешанные ячейки остаются текстом.

Могу ли я получить CSV?

Да. Через API установите output_format=csv; все таблицы записываются одна за другой с пустой строкой между ними.

Это бесплатно?

Да. Три бесплатных конвертирования в день без регистрации; конвертирование стоит 2 кредита, бесплатный тариф включает 300 кредитов в месяц. Платные тарифы начинаются с $19/месяц.

Начните извлекать текст бесплатно

Регистрация не требуется. Обработайте первый файл за секунды.

Посмотреть тарифы