Transcrever Áudio em Texto
Envie um arquivo de áudio e receba a transcrição limpa e pontuada em segundos. O ParseJet transcreve MP3, WAV, M4A, OGG, FLAC e WebM usando reconhecimento de fala em seus próprios servidores — dezenas de idiomas, detecção automática de idioma, segmentos marcados por tempo para legendas. Grátis para testar, sem cadastro; a mesma transcrição está disponível pela API.
Solte um arquivo aqui ou procure
Aceita arquivos MP3,WAV,M4A,OGG,FLAC,WEBM,AAC
Grátis — 3 requisições/dia, sem cadastro. para 300 créditos/mês grátis.
Como funciona
Envie seu áudio
Solte qualquer arquivo acima — memorando de voz, entrevista, aula, ligação. Arquivos grandes são comprimidos no seu navegador primeiro, então até um WAV de 40 MB é enviado em segundos.
Reconhecimento de fala
O idioma é detectado automaticamente e a fala é transcrita nos servidores do ParseJet — nada é enviado a um serviço de IA de terceiros.
Copie sua transcrição
Copie o texto para notas, documentos ou um prompt. Desenvolvedores recebem o mesmo resultado como JSON com marcas de tempo de segmentos e palavras.
Principais recursos
O que faz este audio to text se destacar.
Todos os formatos de áudio
MP3, WAV, M4A, OGG, FLAC, WebM e AAC — direto do telefone, gravador, DAW ou ferramenta de reunião.
Dezenas de idiomas, detectados automaticamente
Inglês, espanhol, português, francês, alemão, japonês, chinês, coreano, árabe, russo e muitos mais. Forneça uma sugestão de idioma para trechos curtos.
Texto legível e pontuado
Frases, pontuação e quebras de parágrafo em pausas — não um bloco de palavras em minúsculas.
Marcas de tempo para legendas
Cada resposta inclui segmentos marcados por tempo; a API pode adicionar marcas de tempo no nível de palavra para legendas SRT ou VTT.
Privado por design
O reconhecimento é executado em servidores operados pelo ParseJet. O áudio é processado em memória e descartado assim que a transcrição é retornada.
Mesmo mecanismo via API
Um POST com o arquivo, JSON de volta. SDKs para Python e JavaScript, 300 créditos grátis por mês.
Casos de uso
Cenários comuns onde esta ferramenta economiza seu tempo.
Entrevistas e podcasts
Transforme uma hora de conversa em texto pesquisável e citável para artigos, notas de episódio e pesquisa.
Reuniões e ligações
Transcreva a gravação e depois cole em Claude ou ChatGPT para gerar atas e itens de ação.
Aulas e memorandos de voz
Gravações de aula ou ideias capturadas na hora se tornam notas que você pode pesquisar e editar.
Legendas e acessibilidade
Use os segmentos marcados por tempo para criar legendas ou publique a transcrição junto com o áudio.
Automatize com a API
Use a mesma ferramenta de forma programática. Funciona com qualquer linguagem — apenas HTTP.
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM) curl -X POST https://api.parsejet.com/v1/parse/audio \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" \ -F "language=en" \ -F "with_timestamps=true" # Response: text + metadata.segments [{start, end, text}] + metadata.words
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/audio",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("interview.mp3", "rb")},
data={"with_timestamps": "true"},
timeout=600,
)
data = resp.json()
print(data["text"]) # the transcript
for seg in data["metadata"]["segments"]: # timed segments for captions
print(f'{seg["start"]:.1f}s {seg["text"]}') const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");
const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
method: "POST",
headers: { Authorization: "Bearer YOUR_API_KEY" },
body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments); Quer automatizar isso?
A ParseJet API oferece o mesmo poder de análise através de um único endpoint HTTP. Sem ffmpeg, sem poppler, sem tesseract — apenas uma chamada de API.
Perguntas frequentes
Como faço para transcrever um arquivo de áudio em texto?
Solte a gravação acima e aguarde um momento; a transcrição aparece abaixo da caixa e você pode copiá-la. Nenhuma conta é necessária para as três primeiras transcrições por dia. Para lotes, envie os arquivos para /v1/parse/audio.
Quanto tempo pode ter a gravação?
Até 5 minutos de áudio por requisição e 25 MB por arquivo. Para gravações mais longas, divida-as (a maioria dos editores consegue cortar em silêncios) e transcreva as partes — a API retorna marcas de tempo, então os trechos se alinham.
Quais idiomas são suportados?
Dezenas, incluindo inglês, espanhol, português, francês, alemão, italiano, holandês, polonês, russo, turco, árabe, japonês, coreano e chinês. O idioma é detectado automaticamente; uma sugestão (language=pt) ajuda em trechos muito curtos.
Qual é a precisão da transcrição?
Fala clara de um ou dois falantes é transcrita com alta precisão, incluindo pontuação. Ruído de fundo intenso, conversas simultâneas e sotaques cerrados reduzem a precisão. Áudio descomprimido ou de alta taxa de bits não ajuda muito — a clareza da fala é mais importante que o formato do arquivo.
Posso obter legendas (SRT) da transcrição?
A resposta inclui segmentos marcados por tempo, e with_timestamps=true adiciona marcas de tempo de palavras, que é tudo que um arquivo SRT ou VTT precisa. Um download de legendas em um clique está no roteiro.
Minha gravação é enviada para terceiros?
Não. O reconhecimento de fala é executado nos próprios servidores do ParseJet com modelos de código aberto. Arquivos grandes são comprimidos no seu navegador antes do envio, e o áudio é descartado assim que a transcrição é retornada.
É grátis?
Sim. Três transcrições grátis por dia sem cadastro. Uma transcrição custa 3 créditos (até 5 minutos de áudio); a conta gratuita inclui 300 créditos por mês. Planos pagos começam em $19/mês.
Ferramentas relacionadas
MP3 to Text Converter
Convert MP3 to text online for free. Upload an audio file and get an accurate transcript in seconds. MP3, WAV, M4A, OGG, FLAC — or transcribe via API.
WAV to Text Converter
Convert WAV to text online for free. Upload a WAV recording and get an accurate AI transcript in seconds — or transcribe audio at scale via the API.
M4A to Text Converter
Convert M4A to text online for free. Transcribe iPhone Voice Memos and M4A recordings into accurate text in seconds — or automate it via the API.
Video to Text — Transcribe Any Video
Transcribe a video to text online for free. Upload MP4, MOV, MKV, WebM or AVI and get an accurate transcript with timestamps — processed in your browser and on our servers, no signup.
Comece a extrair texto gratuitamente
Sem necessidade de cadastro. Analise seu primeiro arquivo em segundos.