ParseJet

PDF a Excel — Extrae tablas del PDF

Sube un PDF y descarga un libro de trabajo de Excel con sus tablas. ParseJet detecta las tablas en cada página, mantiene las filas y columnas intactas, convierte figuras en números reales, y pone cada tabla en su propia hoja. Funciona en facturas, extractos bancarios, informes y exportaciones de datos; los PDF escaneados necesitan la herramienta PDF OCR primero.

Suelta un archivo aquí o examina

Acepta archivos PDF

Gratis — 3 solicitudes/día, sin registro. para 300 créditos/mes gratis.

Los archivos se convierten en los servidores de ParseJet y se eliminan inmediatamente después de la respuesta.

Cómo funciona

1

Sube tu PDF

Arrastra un PDF que contenga tablas — facturas, extractos, listas de precios, informes.

2

Las tablas se detectan

ParseJet encuentra cada tabla por su estructura de columnas y líneas, lee las celdas y escribe los números.

3

Descarga el .xlsx

Una hoja por tabla, nombrada por página. Ábrelo en Excel, Google Sheets o Numbers — u obtén CSV en su lugar a través de la API.

Características principales

Lo que hace que este pdf to excel destaque.

Todas las tablas, cada página

Los documentos de varias páginas se manejan de una vez; cada tabla obtiene su propia hoja nombrada según su página.

Números reales, no texto

1.250,00 se convierte en 1250 para que los totales, ordenamiento y fórmulas funcionen inmediatamente.

Encabezados mantenidos

La primera fila de cada tabla se escribe en negrita y los anchos de columna se ajustan al contenido.

CSV cuando lo quieras

La misma conversión devuelve CSV para scripts e importaciones — pide output_format=csv en la API.

Sin marca de agua, sin correo

Descarga el archivo inmediatamente. Nada se le añade y nada se mantiene de nuestro lado.

Lote a través de la API

Convierte cientos de extractos con pocas líneas de Python o JavaScript.

Casos de uso

Escenarios comunes donde esta herramienta te ahorra tiempo.

Extractos bancarios y de tarjetas

Obtén transacciones en una hoja de cálculo para presupuestos, reconciliación o tiempo de impuestos.

Facturas y listas de precios

Los elementos de línea y precios llegan a celdas que puedes sumar y comparar.

Informes e investigación

Extrae las tablas de datos de un informe en PDF para graficar o analizarlas.

Canalizaciones de datos

Extrae tablas de los PDF entrantes automáticamente y cárgatlas en una base de datos.

Automatiza con la API

Usa la misma herramienta de forma programática. Funciona con cualquier lenguaje — solo HTTP.

cURL
# PDF tables → Excel workbook (one sheet per table)
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=xlsx" \
  -o statement.xlsx

# ... or CSV
curl -X POST https://api.parsejet.com/v1/convert/document \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "output_format=csv" -o statement.csv
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/convert/document",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"files": open("statement.pdf", "rb")},
    data={"output_format": "xlsx"},
    timeout=120,
)
resp.raise_for_status()
open("statement.xlsx", "wb").write(resp.content)
print(resp.headers["x-tables"], "tables")
JavaScript
const formData = new FormData();
formData.append("files", pdfFile);
formData.append("output_format", "xlsx");

const res = await fetch("https://api.parsejet.com/v1/convert/document", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const blob = await res.blob(); // the .xlsx file
console.log(res.headers.get("x-tables"), "tables");

¿Quieres automatizar esto?

ParseJet API te ofrece el mismo poder de análisis a través de un único endpoint HTTP. Sin ffmpeg, sin poppler, sin tesseract — solo una llamada a la API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Leer Documentación de la API

Preguntas frecuentes

¿Cómo convierto un PDF a Excel?

Sube el PDF arriba y haz clic en Convertir. Obtienes un archivo .xlsx con una hoja por tabla encontrada en el documento. Tres conversiones al día son gratis sin una cuenta.

¿Funciona con PDF escaneados?

La detección de tablas necesita una capa de texto. Si tu PDF es un escaneo o una foto, ejecútalo primero a través de la herramienta PDF OCR; la estructura de tabla entonces tiene que ser visible como líneas o columnas alineadas para que la detección la recoja.

¿Por qué dijo que no se encontraron tablas?

El PDF no tiene una capa de texto (escaneo) o sus datos se distribuyen como texto libre en lugar de una cuadrícula. Intenta PDF OCR para escaneos; para documentos solo de texto, la herramienta PDF to Text te da el contenido para remodelar manualmente.

¿Los números serán números en Excel?

Sí. Las celdas que se parecen a números — incluyendo 1.250,00 y -3,5 — se escriben como valores numéricos para que puedas sumar y ordenar. El texto, fechas y celdas mixtas permanecen como texto.

¿Puedo obtener CSV en su lugar?

Sí. A través de la API, establece output_format=csv; todas las tablas se escriben una tras otra con una línea en blanco entre ellas.

¿Es gratis?

Sí. Tres conversiones gratis al día sin registro; una conversión cuesta 2 créditos y la cuenta gratis incluye 300 créditos al mes. Los planes pagos comienzan en $19/mes.

Comienza a extraer texto gratis

No requiere registro. Analiza tu primer archivo en segundos.

Ver Precios