ParseJet

PDF para Excel — Extraia Tabelas de PDFs

Envie um PDF e baixe uma pasta de trabalho Excel com suas tabelas. O ParseJet detecta as tabelas em cada página, mantém linhas e colunas intactas, converte figuras em números reais e coloca cada tabela em sua própria planilha. Funciona em faturas, extratos bancários, relatórios e exportações de dados; PDFs digitalizados precisam da ferramenta PDF OCR primeiro.

Solte um arquivo aqui ou procure

Aceita arquivos PDF

Grátis — 3 requisições/dia, sem cadastro. para 300 créditos/mês grátis.

Os arquivos são convertidos nos servidores do ParseJet e excluídos logo após a resposta.

Como funciona

1

Envie seu PDF

Solte um PDF que contenha tabelas — faturas, extratos, listas de preços, relatórios.

2

Tabelas são detectadas

O ParseJet encontra cada tabela pela sua estrutura de coluna e linhas, lê as células e digita os números.

3

Baixe o .xlsx

Uma planilha por tabela, nomeada pela página. Abra em Excel, Google Sheets ou Numbers — ou obtenha CSV pela API.

Principais recursos

O que faz este pdf to excel se destacar.

Todas as tabelas, toda página

Documentos com múltiplas páginas são tratados de uma vez; cada tabela recebe sua própria planilha nomeada pela página.

Números reais, não texto

1.250,00 se torna 1250 para que totalizações, ordenação e fórmulas funcionem imediatamente.

Cabeçalhos mantidos

A primeira linha de cada tabela é escrita em negrito e a largura das colunas é ajustada ao conteúdo.

CSV quando você quiser

A mesma conversão retorna CSV para scripts e importações — solicite output_format=csv na API.

Sem marca d'água, sem email

Baixe o arquivo imediatamente. Nada é adicionado e nada é mantido no nosso lado.

Lote via API

Converta centenas de extratos com poucas linhas de Python ou JavaScript.

Casos de uso

Cenários comuns onde esta ferramenta economiza seu tempo.

Extratos bancários e de cartão

Obtenha transações em uma planilha para orçamento, reconciliação ou declaração de imposto.

Faturas e listas de preços

Itens de linha e preços chegam em células que você pode somar e comparar.

Relatórios e pesquisa

Retire as tabelas de dados de um relatório em PDF para gráficos ou análise.

Pipelines de dados

Extraia tabelas de PDFs recebidos automaticamente e carregue-as em um banco de dados.

Automatize com a API

Use a mesma ferramenta de forma programática. Funciona com qualquer linguagem — apenas HTTP.

cURL
# PDF tables → Excel workbook (one sheet per table)
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=xlsx" \
  -o statement.xlsx

# ... or CSV
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=csv" -o statement.csv
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/convert/document",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"files": open("statement.pdf", "rb")},
    data={"output_format": "xlsx"},
    timeout=120,
)
resp.raise_for_status()
open("statement.xlsx", "wb").write(resp.content)
print(resp.headers["x-tables"], "tables")
JavaScript
const formData = new FormData();
formData.append("files", pdfFile);
formData.append("output_format", "xlsx");

const res = await fetch("https://api.parsejet.com/v1/convert/document", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const blob = await res.blob(); // the .xlsx file
console.log(res.headers.get("x-tables"), "tables");

Quer automatizar isso?

A ParseJet API oferece o mesmo poder de análise através de um único endpoint HTTP. Sem ffmpeg, sem poppler, sem tesseract — apenas uma chamada de API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Ler Documentação da API

Perguntas frequentes

Como faço para converter um PDF para Excel?

Envie o PDF acima e clique em Converter. Você recebe um arquivo .xlsx com uma planilha por tabela encontrada no documento. Três conversões por dia são grátis sem uma conta.

Funciona com PDFs digitalizados?

A detecção de tabela precisa de uma camada de texto. Se seu PDF é um digitalizador ou foto, execute-o pela ferramenta PDF OCR primeiro; a estrutura da tabela então precisa estar visível como linhas desenhadas ou colunas alinhadas para a detecção trabalhar.

Por que disse que nenhuma tabela foi encontrada?

O PDF não tem uma camada de texto (digitalizador) ou seus dados estão dispostos como texto livre em vez de uma grade. Tente PDF OCR para digitalizadores; para documentos somente texto, a ferramenta PDF para Texto fornece o conteúdo para você reformatar manualmente.

Os números serão números em Excel?

Sim. Células que parecem números — incluindo 1.250,00 e -3,5 — são escritas como valores numéricos para você somar e ordenar. Texto, datas e células mistas permanecem como texto.

Posso obter CSV em vez disso?

Sim. Pela API, defina output_format=csv; todas as tabelas são escritas uma após a outra com uma linha em branco entre elas.

É grátis?

Sim. Três conversões grátis por dia sem cadastro; uma conversão custa 2 créditos e a conta gratuita inclui 300 créditos por mês. Planos pagos começam em $19/mês.

Comece a extrair texto gratuitamente

Sem necessidade de cadastro. Analise seu primeiro arquivo em segundos.

Ver Preços