ParseJet

PDF OCR — Tekenherkenning voor Gescande PDF's

Een gescande PDF is slechts afbeeldingen van pagina's: je kunt er niet in zoeken, tekst selecteren of kopieëren. ParseJet's PDF OCR rendert elke op afbeeldingen gebaseerde pagina, voert tekstherkenning uit op onze eigen servers en geeft het document als tekst terug die je kunt zoeken, kopiëren en hergebruiken. Pagina's die al een tekstlaag hebben, worden ongewijzigd geëxtraheerd, dus gemengde documenten zijn volledig.

Sleep een bestand hierheen of blader

Accepteert PDF bestanden

Gratis — 3 verzoeken/dag, geen aanmelding. voor 300 credits/maand gratis.

Hoe het werkt

1

Upload de gescande PDF

Sleep het bestand hierboven — van een scanner, een telefoonscanner-app of een fax. Digitale PDF's met een tekstlaag werken ook.

2

Tekenherkenning, pagina voor pagina

ParseJet controleert elke pagina. Pagina's met echte tekst worden rechtstreeks gelezen; op afbeeldingen gebaseerde pagina's worden weergegeven en door OCR verwerkt.

3

Kopieer de tekst

Kopieer het hele document, of haal het op als Markdown of platte tekst via de API om te voeden aan zoekopdrachten, spreadsheets of een LLM.

Belangrijkste kenmerken

Wat deze pdf ocr onderscheidt.

Detecteert welke pagina's OCR nodig hebben

Geen configuratie nodig. Een pagina met minder dan een paar dozijn extracteerbare karakters wordt als een scan beschouwd en herkend; elke andere pagina behoudt zijn originele tekst.

20+ talen

Latijnse-script-talen, Vereenvoudigd en Traditioneel Chinees, en Japans hebben geen instellingen nodig. Koreaans, Cyrillisch, Arabisch, Hindi, Thai en Grieks-scans werken met een taalhint.

Gemengde documenten afgehandeld

Contracten met een gescande handtekeningpagina, rapporten met ingevoegde scans — de tekst komt terug in paginavolgordemet de herkende pagina's ingevoegd.

Niets verlaat onze servers

Pagina's worden weergegeven en herkend op ParseJet's eigen infrastructuur met open-source modellen; geen externe AI-service ziet je document.

Markdown of platte tekst

Vraag output_format=markdown om koppen en tabellen van de digitale pagina's te behouden, of raw voor platte tekst.

Tot 30 gescande pagina's per verzoek

Genoeg voor de meeste brieven, formulieren en rapporten. Langere scans: splits het bestand of verwerk het in batches via de API.

Gebruiksscenario's

Veelvoorkomende situaties waarin deze tool je tijd bespaart.

Gearchiveerde contracten en facturen

Maak jaren gescand papierwerk doorzoekbaar — extraheer de tekst eenmaal en indexeer deze.

Telefoon-gescande documenten

Scanner-apps slaan op afbeeldingen gebaseerde PDF's op. Voer ze door OCR om een adres, clausule of totaal te kopiëren.

Oude boeken en rapporten

Zet gescande pagina's om in tekst voor citeren, vertaling of toegankelijkheidshulpmiddelen.

Scans naar AI voeren

Claude en ChatGPT kunnen een foto van een pagina niet betrouwbaar lezen. OCR eerst, kopieer of pipe vervolgens de tekst in.

Automatiseer met de API

Gebruik dezelfde tool programmatisch. Werkt met elke taal — gewoon HTTP.

cURL
# Scanned pages are detected and OCR'd automatically
curl -X POST "https://api.parsejet.com/v1/parse/auto/file?output_format=markdown" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]"

# Non-Latin scripts: add a language hint (ko, ru, ar, hi, th, el ...)
curl -X POST "https://api.parsejet.com/v1/parse/auto/file?language=ru" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]"

# Response metadata tells you which pages were recognized:
# "metadata": { "ocr_pages": [1, 2, 3], ... }
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/auto/file",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("scan.pdf", "rb")},
    params={"output_format": "markdown"},
    timeout=120,
)
data = resp.json()
print(data["text"])
print("OCR'd pages:", data["metadata"].get("ocr_pages", []))
JavaScript
const formData = new FormData();
formData.append("file", pdfFile);

const res = await fetch(
  "https://api.parsejet.com/v1/parse/auto/file?output_format=markdown",
  { method: "POST", headers: { Authorization: "Bearer YOUR_API_KEY" }, body: formData },
);
const { text, metadata } = await res.json();
console.log(text);
console.log("OCR'd pages:", metadata.ocr_pages ?? []);

Wil je dit automatiseren?

ParseJet API geeft je dezelfde parsingkracht via één HTTP endpoint. Geen ffmpeg, geen poppler, geen tesseract — slechts één API-aanroep.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
API-documentatie lezen

Veelgestelde vragen

Hoe OCR'ik ik een PDF?

Upload de PDF hierboven. ParseJet bekijkt elke pagina, herkent de pagina's die alleen afbeeldingen zijn en toont je de volledige tekst — meestal binnen enkele seconden voor een typische brief of formulier. Kopieer het, of roep de API aan om hetzelfde voor veel bestanden te doen.

Hoe weet ik of mijn PDF OCR nodig heeft?

Open het en probeer een woord te selecteren. Als er niets is gemarkeerd, of inzoomen maakt de letters pixelachtig als een foto, is de pagina een afbeelding en heeft OCR nodig. PDF's van scanners, faxmachines en telefoonscanner-apps zijn bijna altijd zo.

Krijg ik een doorzoekbare PDF terug?

Je krijgt de tekst, niet een nieuw PDF-bestand. Dat is wat je nodig hebt voor kopiëren, zoeken, indexeren, vertaling of het voeren van een AI-model. Als je specifiek het originele PDF met een onzichtbare tekstlaag wilt toevoegen, doet een desktophulpmiddel zoals OCRmyPDF dat.

Is er een paginalimieter?

Tot 30 gescande pagina's worden per verzoek herkend; pagina's die al tekst bevatten tellen niet. Voor langere scans, splits het bestand of stuur het in delen via de API. De antwoordmetagegevens geven de herkende pagina's en eventueel overgeslagen pagina's aan.

Welke talen worden ondersteund?

Engels en alle Latijnse-script-talen, Vereenvoudigd en Traditioneel Chinees, en Japans werken automatisch. Voor Koreaans, Russisch en andere Cyrillische talen, Arabisch, Hindi, Thai of Grieks, geef language=ko, ru, ar, hi, th of el door (de gelokaliseerde versies van deze pagina doen het voor je).

Is het gratis?

Ja. Drie gratis conversies per dag zonder aanmelding, 300 credits per maand met een gratis account, en betaalde plannen vanaf $19/maand voor grotere bestanden en hogere quota.

Start gratis met tekst extraheren

Geen aanmelding nodig. Parse je eerste bestand in seconden.

Bekijk Prijzen