PDF OCR — Tekenherkenning voor Gescande PDF's
Een gescande PDF is slechts afbeeldingen van pagina's: je kunt er niet in zoeken, tekst selecteren of kopieëren. ParseJet's PDF OCR rendert elke op afbeeldingen gebaseerde pagina, voert tekstherkenning uit op onze eigen servers en geeft het document als tekst terug die je kunt zoeken, kopiëren en hergebruiken. Pagina's die al een tekstlaag hebben, worden ongewijzigd geëxtraheerd, dus gemengde documenten zijn volledig.
Sleep een bestand hierheen of blader
Accepteert PDF bestanden
Gratis — 3 verzoeken/dag, geen aanmelding. voor 300 credits/maand gratis.
Hoe het werkt
Upload de gescande PDF
Sleep het bestand hierboven — van een scanner, een telefoonscanner-app of een fax. Digitale PDF's met een tekstlaag werken ook.
Tekenherkenning, pagina voor pagina
ParseJet controleert elke pagina. Pagina's met echte tekst worden rechtstreeks gelezen; op afbeeldingen gebaseerde pagina's worden weergegeven en door OCR verwerkt.
Kopieer de tekst
Kopieer het hele document, of haal het op als Markdown of platte tekst via de API om te voeden aan zoekopdrachten, spreadsheets of een LLM.
Belangrijkste kenmerken
Wat deze pdf ocr onderscheidt.
Detecteert welke pagina's OCR nodig hebben
Geen configuratie nodig. Een pagina met minder dan een paar dozijn extracteerbare karakters wordt als een scan beschouwd en herkend; elke andere pagina behoudt zijn originele tekst.
20+ talen
Latijnse-script-talen, Vereenvoudigd en Traditioneel Chinees, en Japans hebben geen instellingen nodig. Koreaans, Cyrillisch, Arabisch, Hindi, Thai en Grieks-scans werken met een taalhint.
Gemengde documenten afgehandeld
Contracten met een gescande handtekeningpagina, rapporten met ingevoegde scans — de tekst komt terug in paginavolgordemet de herkende pagina's ingevoegd.
Niets verlaat onze servers
Pagina's worden weergegeven en herkend op ParseJet's eigen infrastructuur met open-source modellen; geen externe AI-service ziet je document.
Markdown of platte tekst
Vraag output_format=markdown om koppen en tabellen van de digitale pagina's te behouden, of raw voor platte tekst.
Tot 30 gescande pagina's per verzoek
Genoeg voor de meeste brieven, formulieren en rapporten. Langere scans: splits het bestand of verwerk het in batches via de API.
Gebruiksscenario's
Veelvoorkomende situaties waarin deze tool je tijd bespaart.
Gearchiveerde contracten en facturen
Maak jaren gescand papierwerk doorzoekbaar — extraheer de tekst eenmaal en indexeer deze.
Telefoon-gescande documenten
Scanner-apps slaan op afbeeldingen gebaseerde PDF's op. Voer ze door OCR om een adres, clausule of totaal te kopiëren.
Oude boeken en rapporten
Zet gescande pagina's om in tekst voor citeren, vertaling of toegankelijkheidshulpmiddelen.
Scans naar AI voeren
Claude en ChatGPT kunnen een foto van een pagina niet betrouwbaar lezen. OCR eerst, kopieer of pipe vervolgens de tekst in.
Automatiseer met de API
Gebruik dezelfde tool programmatisch. Werkt met elke taal — gewoon HTTP.
# Scanned pages are detected and OCR'd automatically curl -X POST "https://api.parsejet.com/v1/parse/auto/file?output_format=markdown" \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" # Non-Latin scripts: add a language hint (ko, ru, ar, hi, th, el ...) curl -X POST "https://api.parsejet.com/v1/parse/auto/file?language=ru" \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" # Response metadata tells you which pages were recognized: # "metadata": { "ocr_pages": [1, 2, 3], ... }
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/auto/file",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("scan.pdf", "rb")},
params={"output_format": "markdown"},
timeout=120,
)
data = resp.json()
print(data["text"])
print("OCR'd pages:", data["metadata"].get("ocr_pages", [])) const formData = new FormData();
formData.append("file", pdfFile);
const res = await fetch(
"https://api.parsejet.com/v1/parse/auto/file?output_format=markdown",
{ method: "POST", headers: { Authorization: "Bearer YOUR_API_KEY" }, body: formData },
);
const { text, metadata } = await res.json();
console.log(text);
console.log("OCR'd pages:", metadata.ocr_pages ?? []); Wil je dit automatiseren?
ParseJet API geeft je dezelfde parsingkracht via één HTTP endpoint. Geen ffmpeg, geen poppler, geen tesseract — slechts één API-aanroep.
Veelgestelde vragen
Hoe OCR'ik ik een PDF?
Upload de PDF hierboven. ParseJet bekijkt elke pagina, herkent de pagina's die alleen afbeeldingen zijn en toont je de volledige tekst — meestal binnen enkele seconden voor een typische brief of formulier. Kopieer het, of roep de API aan om hetzelfde voor veel bestanden te doen.
Hoe weet ik of mijn PDF OCR nodig heeft?
Open het en probeer een woord te selecteren. Als er niets is gemarkeerd, of inzoomen maakt de letters pixelachtig als een foto, is de pagina een afbeelding en heeft OCR nodig. PDF's van scanners, faxmachines en telefoonscanner-apps zijn bijna altijd zo.
Krijg ik een doorzoekbare PDF terug?
Je krijgt de tekst, niet een nieuw PDF-bestand. Dat is wat je nodig hebt voor kopiëren, zoeken, indexeren, vertaling of het voeren van een AI-model. Als je specifiek het originele PDF met een onzichtbare tekstlaag wilt toevoegen, doet een desktophulpmiddel zoals OCRmyPDF dat.
Is er een paginalimieter?
Tot 30 gescande pagina's worden per verzoek herkend; pagina's die al tekst bevatten tellen niet. Voor langere scans, splits het bestand of stuur het in delen via de API. De antwoordmetagegevens geven de herkende pagina's en eventueel overgeslagen pagina's aan.
Welke talen worden ondersteund?
Engels en alle Latijnse-script-talen, Vereenvoudigd en Traditioneel Chinees, en Japans werken automatisch. Voor Koreaans, Russisch en andere Cyrillische talen, Arabisch, Hindi, Thai of Grieks, geef language=ko, ru, ar, hi, th of el door (de gelokaliseerde versies van deze pagina doen het voor je).
Is het gratis?
Ja. Drie gratis conversies per dag zonder aanmelding, 300 credits per maand met een gratis account, en betaalde plannen vanaf $19/maand voor grotere bestanden en hogere quota.
Gerelateerde tools
Image to Text — Free OCR (Optical Character Recognition)
Convert image to text online for free. OCR reads JPG, PNG, WebP and photos in 20+ languages and returns copy-ready text — no signup. API for developers too.
PDF to Text Converter
Convert PDF to text online for free. This PDF text converter handles multi-page files, scanned PDFs (OCR), and complex layouts. No signup — or automate via API.
Extract Text from PDF
Extract text from any PDF in seconds — digital or scanned. Drop the file, copy the text. Free, no signup, nothing to install; developers get the same via API.
PDF to Markdown Converter
Convert PDF to Markdown online for free. Preserves headings, lists, tables, and code blocks. No signup required — try it instantly or automate via API.
Start gratis met tekst extraheren
Geen aanmelding nodig. Parse je eerste bestand in seconden.