ParseJet

HTML naar Tekst Converter

Plak een URL of upload een .html-bestand en krijg schone platte tekst terug, met elke tag, script en style eruit gestript. ParseJet decodeert HTML-entities, bewaart de leesvolgorde en geeft tekst terug waar je echt iets mee kunt — gratis, zonder aanmelding.

Sleep een bestand hierheen of blader

Accepteert HTML,HTM bestanden

Gratis — 3 verzoeken/dag, geen aanmelding. voor 300 credits/maand gratis.

Hoe het werkt

1

Upload HTML of plak een URL

Sleep hierboven een .html-bestand naar het vak, of plak de URL van een live pagina — beide routes leveren dezelfde schone tekst op.

2

Tags eruit, tekst blijft

ParseJet parseert de markup, verwijdert tags, scripts, styles en commentaar en decodeert entities als & en   naar echte tekens.

3

Kopieer je tekst

Kopieer de platte tekst voor zoekindexering, NLP of gewoon lezen — of roep de API aan om HTML naar tekst om te zetten in je eigen pijplijn.

Belangrijkste kenmerken

Wat deze html to text onderscheidt.

Volledige tagverwijdering

Elke HTML-tag verdwijnt — inclusief scripts, inline styles, trackingpixels en commentaar. Alleen de leesbare tekst blijft over.

Entities gedecodeerd

&,  , —, ’ en elke andere entity wordt gedecodeerd naar het echte teken. De output is altijd schone UTF-8.

Leesvolgorde behouden

De tekst komt eruit in de volgorde waarin een mens hem leest — niet in DOM-volgorde, door layout-divs door elkaar gehusseld.

Ook rommelige HTML

Niet-gesloten tags, geneste verouderde markup, inline styles — HTML uit de praktijk wordt geparseerd zonder dat de output sneuvelt.

Bestand of URL als invoer

Converteer opgeslagen .html-bestanden of haal een live pagina op via de URL — dezelfde API verwerkt beide.

Markdown als je dat wilt

Liever structuur dan platte tekst? Hetzelfde endpoint geeft Markdown terug met koppen en lijsten — laat gewoon output_format=raw weg.

Gebruiksscenario's

Veelvoorkomende situaties waarin deze tool je tijd bespaart.

Zoekindexering en NLP

Voer zoekmachines en NLP-modellen de tekstinhoud van pagina's — zonder markup-ruis die je index opblaast.

Voorbewerking voor LLM's

Ruwe HTML verspilt tokens aan tags. Strip eerst naar platte tekst en er past veel meer echte inhoud in een prompt.

E-mails en nieuwsbrieven

Haal de leesbare tekst uit HTML-e-mails en nieuwsbrieven voor archivering, citaten of platte-tekstversies.

Output van je scraper

Zet gecrawlde HTML om naar schone tekst voor opslag en analyse — één API-call per document.

Automatiseer met de API

Gebruik dezelfde tool programmatisch. Werkt met elke taal — gewoon HTTP.

cURL
# Convert an HTML file to plain text
curl -X POST "https://api.parsejet.com/v1/parse/auto/file?output_format=raw" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]"

# Convert a live page by URL
curl -X POST "https://api.parsejet.com/v1/parse/webpage?output_format=raw" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"url": "https://example.com/page"}'
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/auto/file",
    params={"output_format": "raw"},
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("page.html", "rb")},
)
print(resp.json()["text"])  # plain text, tags stripped
JavaScript
const formData = new FormData();
formData.append("file", htmlFile);

const res = await fetch(
  "https://api.parsejet.com/v1/parse/auto/file?output_format=raw",
  {
    method: "POST",
    headers: { Authorization: "Bearer YOUR_API_KEY" },
    body: formData,
  }
);
const { text } = await res.json(); // plain text

Wil je dit automatiseren?

ParseJet API geeft je dezelfde parsingkracht via één HTTP endpoint. Geen ffmpeg, geen poppler, geen tesseract — slechts één API-aanroep.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
API-documentatie lezen

Veelgestelde vragen

Hoe converteer ik HTML naar platte tekst?

Upload hierboven een .html-bestand of plak een URL — ParseJet verwijdert alle markup en geeft de leesbare tekst terug. Voor automatisering POST je naar /v1/parse/auto/file met output_format=raw.

Worden scripts en CSS ook verwijderd?

Ja. JavaScript, style-blokken, inline styles, HTML-commentaar en trackingcode worden allemaal verwijderd — daar lekt niets van door naar de tekstoutput.

Wat gebeurt er met HTML-entities zoals & en  ?

Die worden gedecodeerd naar hun echte tekens (&, een spatie, gedachtestreepjes, gekrulde aanhalingstekens, enzovoort), zodat de output leest als normale tekst en niet als geëscapete markup.

Kan ik een live webpagina converteren in plaats van een bestand?

Ja. Plak de pagina-URL in de tool, of POST hem naar /v1/parse/webpage — ParseJet haalt de pagina op en extraheert de hoofdinhoud als tekst.

En als ik Markdown wil in plaats van platte tekst?

Gebruik hetzelfde endpoint zonder output_format=raw — ParseJet geeft dan Markdown terug met koppen, lijsten, tabellen en links intact. Zie onze HTML naar Markdown-tool.

Is het gratis?

Ja. Je krijgt 3 gratis conversies per dag zonder aanmelding, en een gratis API-account bevat 300 credits per maand. Betaalde abonnementen beginnen vanaf $19/maand.

Start gratis met tekst extraheren

Geen aanmelding nodig. Parse je eerste bestand in seconden.

Bekijk Prijzen