ParseJet

Video in Text umwandeln — Jedes Video

Laden Sie ein Video hoch und erhalten Sie alles, was darin gesagt wird, als Text. Ihr Browser extrahiert zunächst die Audiospur, sodass eine 500-MB-Bildschirmaufnahme oder Handyvideo nur ein paar Megabyte Upload ist; ParseJet transkribiert es dann mit Spracherkennung auf eigenen Servern. Dutzende Sprachen, Interpunktion, zeitgesteuerte Segmente — kostenlos zum Ausprobieren, und das gleiche Ergebnis ist ein API-Aufruf für Entwickler.

Datei hier ablegen oder durchsuchen

Akzeptiert MP4,MOV,MKV,WEBM,AVI,WMV,M4V,FLV,3GP Dateien

Kostenlos — 3 Anfragen/Tag, keine Anmeldung. für 300 Credits/Monat kostenlos.

So funktioniert es

1

Laden Sie Ihr Video hoch

Ziehen Sie eine MP4, MOV, MKV, WebM, AVI, WMV oder M4V hin. Die Audiospur wird in Ihrem Browser extrahiert, sodass das Video selbst nicht hochgeladen werden muss.

2

Spracherkennung

Die Sprache wird erkannt und die Sprache auf ParseJets Servern transkribiert, mit Interpunktion und Absatzumbrüchen bei Pausen.

3

Kopieren Sie das Transkript

Kopieren Sie den Text für Notizen, Untertitel oder eine Zusammenfassung, oder holen Sie ihn als JSON mit Zeitstempeln über die API.

Hauptfunktionen

Was dieses video to text auszeichnet.

Alle gängigen Videoformate

MP4, MOV, MKV, WebM, AVI, WMV, M4V, FLV und 3GP — Handyvideos, Bildschirmaufnahmen, Zoom-Exporte, Kameradateien.

Keine großen Uploads

Nur eine kompakte Mono-Audiospur verlässt Ihren Computer: etwa 360 KB pro Minute, unabhängig von der Videoauflösung.

Dutzende Sprachen

Automatisch erkannt; Englisch, Spanisch, Portugiesisch, Französisch, Deutsch, Japanisch, Chinesisch, Koreanisch, Arabisch, Russisch und mehr.

Zeitstempel enthalten

Zeitgesteuerte Segmente kommen mit jedem Transkript zurück — das Rohmaterial für Untertitel und Kapitelmarker.

Datenschutz nach Entwurf

Die Erkennung läuft auf Servern, die ParseJet mit Open-Source-Modellen betreibt; Audio wird nach Rückgabe des Transkripts verworfen.

API für Skalierbarkeit

POST eine Videodatei an /v1/parse/video und erhalten Sie das Transkript als JSON. Python- und JavaScript-SDKs verfügbar.

Anwendungsfälle

Häufige Szenarien, in denen dieses Tool Zeit spart.

Vorlesungen und Webinare

Verwandeln Sie eine aufgezeichnete Klasse oder ein Webinar in durchsuchbare, zitierbare Notizen, die Sie zusammenfassen können.

Besprechungsaufzeichnungen

Zoom-, Teams- und Meet-Exporte werden zu Notizen und Maßnahmen — fügen Sie das Transkript in Ihren KI-Assistenten ein.

Untertitel und Beschriftungen

Verwenden Sie die zeitgesteuerten Segmente, um ein Video für soziale Medien oder Barrierefreiheit zu beschriften.

Inhalte umgestalten

Verfassen Sie den Blogbeitrag, Newsletter oder Thread aus dem, was tatsächlich im Video gesagt wurde.

Mit der API automatisieren

Nutzen Sie dasselbe Tool programmatisch. Funktioniert mit jeder Sprache – einfach HTTP.

cURL
# Transcribe a video file (MP4, MOV, MKV, WebM, AVI ...)
curl -X POST https://api.parsejet.com/v1/parse/video \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en"

# Response: text + metadata.segments [{start, end, text}], duration, language
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/video",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("lecture.mp4", "rb")},
    timeout=600,
)
data = resp.json()
print(data["text"])
print(data["metadata"]["duration"], "seconds,", data["metadata"]["language"])
JavaScript
const formData = new FormData();
formData.append("file", videoFile); // MP4, MOV, MKV, WebM, AVI ...

const res = await fetch("https://api.parsejet.com/v1/parse/video", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

Möchten Sie dies automatisieren?

Die ParseJet API bietet Ihnen die gleiche Parsing-Leistung über einen einzigen HTTP-Endpunkt. Kein ffmpeg, kein poppler, kein tesseract — nur ein API-Aufruf.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
API-Dokumentation lesen

Häufig gestellte Fragen

Wie transkribiere ich ein Video in Text?

Ziehen Sie das Video oben hin. Ihr Browser extrahiert die Audiospur, lädt diese kleine Datei hoch, und das Transkript wird unter dem Feld angezeigt — kopieren Sie es von dort. Drei Transkriptionen pro Tag sind kostenlos ohne Konto.

Muss ich das ganze Video hochladen?

Nein. Die Audiospur wird in Ihrem Browser extrahiert und nur diese wird gesendet — etwa 360 KB pro Minute. Eine 2-GB-Aufnahme funktioniert immer noch; beim ersten Durchlauf wird der In-Browser-Konverter (etwa 30 MB) einmal heruntergeladen.

Wie lange kann das Video sein?

Bis zu 5 Minuten Audio pro Anfrage. Bei längeren Videos schneiden oder teilen Sie die Datei auf, oder senden Sie die Teile über die API — Zeitstempel ermöglichen es, die Transkripte leicht wieder zusammenzusetzen.

Welche Sprachen werden unterstützt?

Dutzende, automatisch erkannt: Englisch, Spanisch, Portugiesisch, Französisch, Deutsch, Italienisch, Niederländisch, Polnisch, Russisch, Türkisch, Arabisch, Japanisch, Koreanisch, Chinesisch und mehr. Fügen Sie language=xx für kurze Clips hinzu.

Kann ich ein YouTube-Video transkribieren?

Verwenden Sie das YouTube-Transkript-Tool: Es ruft die Beschriftungen ab, wenn diese vorhanden sind, transkribiert andernfalls das Audio. Diese Seite ist für Videodateien auf Ihrem Gerät gedacht.

Ist es kostenlos?

Ja. Drei kostenlose Transkriptionen pro Tag ohne Anmeldung. Eine Videotranskription kostet 5 Credits (bis zu 5 Minuten Audio); das kostenlose Konto umfasst 300 Credits pro Monat. Kostenpflichtige Pläne beginnen bei 19 $/Monat.

Kostenlos mit Textextraktion starten

Keine Anmeldung erforderlich. Parsen Sie Ihre erste Datei in Sekunden.

Preise ansehen