ParseJet

Trascrivere audio in testo

Carica una registrazione e ricevi la trascrizione pulita e punteggiata in pochi secondi. ParseJet trascrive MP3, WAV, M4A, OGG, FLAC e WebM con il riconoscimento vocale che gira sui nostri server — dozzine di lingue, rilevamento automatico, segmenti temporizzati per i sottotitoli. Gratis e senza iscrizione; gli sviluppatori ottengono lo stesso risultato tramite API.

Trascina un file qui o sfoglia

Accetta file MP3,WAV,M4A,OGG,FLAC,WEBM,AAC

Gratuito — 3 richieste/giorno, nessuna registrazione. per 300 crediti/mese gratuiti.

Come funziona

1

Carica l'audio

Trascina qualsiasi registrazione — memo vocale, intervista, lezione, chiamata. I file grandi vengono compressi dal tuo browser, quindi anche un WAV di 40 MB si carica in pochi secondi.

2

Riconoscimento vocale

La lingua viene rilevata automaticamente e il parlato viene trascritto sui server di ParseJet — niente viene inviato a servizi AI di terze parti.

3

Copia la trascrizione

Copia il testo in appunti, documenti o un prompt. Gli sviluppatori ottengono lo stesso risultato come JSON con timestamp di segmenti e parole.

Funzionalità principali

Cosa rende questo audio to text unico.

Tutti i formati audio comuni

MP3, WAV, M4A, OGG, FLAC, WebM e AAC — direttamente da telefono, registratore, DAW o strumento di conferenza.

Dozzine di lingue, rilevate automaticamente

Inglese, spagnolo, portoghese, francese, tedesco, giapponese, cinese, coreano, arabo, russo e molte altre. Fornisci un suggerimento linguistico per clip brevi.

Testo leggibile e punteggiato

Frasi, punteggiatura e interruzioni di paragrafo alle pause — non una massa di parole minuscole.

Timestamp per i sottotitoli

Ogni risposta include segmenti temporizzati; l'API può aggiungere timing a livello di parola per sottotitoli SRT o VTT.

Privato per design

Il riconoscimento gira su server gestiti da ParseJet. L'audio viene elaborato in memoria e scartato una volta ottenuta la trascrizione.

Lo stesso motore via API

Un POST con il file, JSON in risposta. SDK Python e JavaScript, 300 crediti gratuiti al mese.

Casi d'uso

Scenari comuni in cui questo strumento ti fa risparmiare tempo.

Interviste e podcast

Trasforma un'ora di conversazione in testo ricercabile e citabile per articoli, note di trasmissione e ricerca.

Riunioni e chiamate

Trascrivi la registrazione, poi incollala in Claude o ChatGPT per verbali e azioni.

Lezioni e memo vocali

Le registrazioni di classe o idee catturate al volo diventano note che puoi cercare e modificare.

Sottotitoli e accessibilità

Usa i segmenti temporizzati per produrre sottotitoli, o pubblica la trascrizione insieme all'audio.

Automatizza con l'API

Usa lo stesso strumento in modo programmatico. Funziona con qualsiasi linguaggio — basta HTTP.

cURL
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM)
curl -X POST https://api.parsejet.com/v1/parse/audio \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en" \
  -F "with_timestamps=true"

# Response: text + metadata.segments [{start, end, text}] + metadata.words
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/audio",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("interview.mp3", "rb")},
    data={"with_timestamps": "true"},
    timeout=600,
)
data = resp.json()
print(data["text"])                       # the transcript
for seg in data["metadata"]["segments"]:  # timed segments for captions
    print(f'{seg["start"]:.1f}s  {seg["text"]}')
JavaScript
const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");

const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

Vuoi automatizzare questo processo?

L'API ParseJet ti offre la stessa potenza di analisi tramite un singolo endpoint HTTP. Niente ffmpeg, poppler o tesseract — basta una sola chiamata API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Leggi la Documentazione API

Domande frequenti

Come faccio a trascrivere un file audio in testo?

Trascina la registrazione sopra e attendi un momento; la trascrizione appare sotto il riquadro e puoi copiarla. Non è necessario un account per le prime tre trascrizioni al giorno. Per batch, invia i file a /v1/parse/audio.

Quanto può essere lunga la registrazione?

Fino a 5 minuti di audio per richiesta e 25 MB per file. Per registrazioni più lunghe: dividile (la maggior parte degli editor può tagliare al silenzio) e trascrivi le parti — l'API restituisce timestamp, quindi i pezzi si allineano.

Quali lingue sono supportate?

Dozzine, incluso inglese, spagnolo, portoghese, francese, tedesco, italiano, olandese, polacco, russo, turco, arabo, giapponese, coreano e cinese. La lingua viene rilevata automaticamente; un suggerimento (language=es) aiuta su clip molto brevi.

Quanto è accurata la trascrizione?

Il parlato chiaro di uno o due oratori viene trascritto con alta precisione, inclusa la punteggiatura. Il rumore di fondo pesante, le sovrapposizioni e gli accenti forti la riducono. L'audio non compresso o a bitrate elevato non aiuta molto — la chiarezza del parlato conta più del formato del file.

Posso ottenere sottotitoli (SRT) dalla trascrizione?

La risposta include segmenti temporizzati e with_timestamps=true aggiunge timing delle parole, che è tutto ciò che serve a un file SRT o VTT. Un download di sottotitoli con un clic è in roadmap.

La mia registrazione viene caricata presso una terza parte?

No. Il riconoscimento vocale gira sui server di ParseJet con modelli open-source. I file grandi vengono compressi nel tuo browser prima del caricamento e l'audio viene scartato una volta ottenuta la trascrizione.

È gratis?

Sì. Tre trascrizioni gratis al giorno senza iscrizione. Una trascrizione costa 3 crediti (fino a 5 minuti di audio); il piano gratuito include 300 crediti al mese. I piani a pagamento partono da 19 euro/mese.

Inizia a estrarre testo gratuitamente

Nessuna registrazione richiesta. Analizza il tuo primo file in pochi secondi.

Vedi i Prezzi