ParseJet

Wideo na tekst — transkrybuj każde wideo

Prześlij wideo i uzyskaj wszystko, co się w nim mówi, jako tekst. Twoja przeglądarka najpierw wyodrębnia ścieżkę audio, więc zapis ekranu o rozmiarze 500 MB lub wideo telefonu przesyła się jako kilka megabajtów; ParseJet następnie transkrybuje je za pomocą rozpoznawania mowy działającego na naszych własnych serwerach. Dziesiątki języków, interpunkcja, segmenty czasowe — całkowicie darmowe, a ten sam rezultat to jedno wywołanie API dla programistów.

Upuść plik tutaj lub przeglądaj

Akceptuje pliki MP4,MOV,MKV,WEBM,AVI,WMV,M4V,FLV,3GP

Darmowe — 3 żądania/dzień, bez rejestracji. za 300 kredytów/miesiąc za darmo.

Jak to działa

1

prześlij swoje wideo

Upuść MP4, MOV, MKV, WebM, AVI, WMV lub M4V. Audio jest wyodrębniane w przeglądarce, więc samo wideo nigdy nie musi być przesyłane.

2

rozpoznawanie mowy

Język jest rozpoznawany, a mowa transkrybowana na serwerach ParseJet — z interpunkcją i podziałami akapitów na pauzach.

3

skopiuj transkrypt

Skopiuj tekst do notatek, napisów lub streszczenia, lub pobierz go jako JSON ze znacznikami czasu przez API.

Kluczowe funkcje

Co wyróżnia to video to text.

każdy popularny format wideo

MP4, MOV, MKV, WebM, AVI, WMV, M4V, FLV i 3GP — wideo z telefonu, nagrania ekranu, eksporty Zoom, pliki z kamery.

bez ogromnych przesyłek

Tylko kompaktowa ścieżka audio mono opuszcza Twoją maszynę: około 360 KB na minutę, niezależnie od rozdzielczości wideo.

dziesiątki języków

Automatycznie rozpoznawane; angielski, hiszpański, portugalski, francuski, niemiecki, japoński, chiński, koreański, arabski, rosyjski i wiele więcej.

znaczniki czasu zawarte

Segmenty czasowe pojawiają się w każdym transkrypcie — surowiec do napisów i markerów rozdziałów.

prywatne z założenia

Rozpoznawanie działa na serwerach ParseJet z modelami open-source; audio jest usuwane po zwróceniu transkryptu.

API dla skali

Prześlij plik wideo do /v1/parse/video i otrzymaj transkrypt jako JSON. Dostępne SDK dla Pythona i JavaScriptu.

Przykłady zastosowań

Typowe scenariusze, w których to narzędzie oszczędza czas.

wykłady i webinaria

Zamień nagrany kurs lub webinar na notatki, które możesz przeszukiwać, cytować i streszczać.

nagrania spotkań

Eksporty Zoom, Teams i Meet stają się notatkami i punktami działań — wklej transkrypt do asystenta AI.

napisy i podpisy

Użyj segmentów czasowych do opatrywania napisami wideo do mediów społecznych lub dostępności.

Zmiana przeznaczenia treści

Stwórz post na blogu, biuletyn lub wątek na podstawie tego, co faktycznie mówiono w filmie.

Automatyzuj za pomocą API

Użyj tego samego narzędzia programistycznie. Działa z dowolnym językiem — wystarczy HTTP.

cURL
# Transcribe a video file (MP4, MOV, MKV, WebM, AVI ...)
curl -X POST https://api.parsejet.com/v1/parse/video \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en"

# Response: text + metadata.segments [{start, end, text}], duration, language
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/video",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("lecture.mp4", "rb")},
    timeout=600,
)
data = resp.json()
print(data["text"])
print(data["metadata"]["duration"], "seconds,", data["metadata"]["language"])
JavaScript
const formData = new FormData();
formData.append("file", videoFile); // MP4, MOV, MKV, WebM, AVI ...

const res = await fetch("https://api.parsejet.com/v1/parse/video", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

Chcesz to zautomatyzować?

ParseJet API daje Ci tę samą moc parsowania przez jeden punkt końcowy HTTP. Bez ffmpeg, bez poppler, bez tesseract — tylko jedno wywołanie API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Przeczytaj dokumentację API

Często zadawane pytania

Jak transkrybuje wideo na tekst?

Upuść wideo powyżej. Twoja przeglądarka wyodrębnia ścieżkę audio, przesyła ten mały plik, a transkrypt pojawi się poniżej pola — skopiuj go stamtąd. Trzy transkrypcje dziennie są darmowe bez konta.

Czy muszę przesłać całe wideo?

Nie. Audio jest wyodrębniane w przeglądarce i tylko to jest wysyłane — około 360 KB na minutę. Nawet nagranie o rozmiarze 2 GB działa; przy pierwszym uruchomieniu pobiera konwerter w przeglądarce (około 30 MB) raz.

Jak długo może być wideo?

Do 5 minut audio na żądanie. Dłuższe wideo: przytnij lub podziel plik, lub wyślij części przez API — znaczniki czasu ułatwiają połączenie transkryptów z powrotem.

Które języki są obsługiwane?

Dziesiątki, automatycznie rozpoznawane: angielski, hiszrański, portugalski, francuski, niemiecki, włoski, holenderski, polski, rosyjski, turecki, arabski, japoński, koreański, chiński i wiele więcej. Dodaj language=xx dla krótkich klipów.

Czy mogę transkrybować wideo YouTube?

Użyj narzędzia YouTube Transcript: pobiera napisy, gdy istnieją, w przeciwnym razie transkrybuje audio. Ta strona jest dla plików wideo na Twoim urządzeniu.

Czy to jest darmowe?

Tak. Trzy darmowe transkrypcje dziennie bez rejestracji. Transkrypcja wideo kosztuje 5 punktów (do 5 minut audio); darmowe konto zawiera 300 punktów miesięcznie. Plany płatne zaczynają się od 19 zł/miesiąc.

Zacznij bezpłatnie wyodrębniać tekst

Bez rejestracji. Przeanalizuj swój pierwszy plik w kilka sekund.

Zobacz cennik