ParseJet

Transcrever Áudio em Texto

Envie um arquivo de áudio e receba a transcrição limpa e pontuada em segundos. O ParseJet transcreve MP3, WAV, M4A, OGG, FLAC e WebM usando reconhecimento de fala em seus próprios servidores — dezenas de idiomas, detecção automática de idioma, segmentos marcados por tempo para legendas. Grátis para testar, sem cadastro; a mesma transcrição está disponível pela API.

Solte um arquivo aqui ou procure

Aceita arquivos MP3,WAV,M4A,OGG,FLAC,WEBM,AAC

Grátis — 3 requisições/dia, sem cadastro. para 300 créditos/mês grátis.

Como funciona

1

Envie seu áudio

Solte qualquer arquivo acima — memorando de voz, entrevista, aula, ligação. Arquivos grandes são comprimidos no seu navegador primeiro, então até um WAV de 40 MB é enviado em segundos.

2

Reconhecimento de fala

O idioma é detectado automaticamente e a fala é transcrita nos servidores do ParseJet — nada é enviado a um serviço de IA de terceiros.

3

Copie sua transcrição

Copie o texto para notas, documentos ou um prompt. Desenvolvedores recebem o mesmo resultado como JSON com marcas de tempo de segmentos e palavras.

Principais recursos

O que faz este audio to text se destacar.

Todos os formatos de áudio

MP3, WAV, M4A, OGG, FLAC, WebM e AAC — direto do telefone, gravador, DAW ou ferramenta de reunião.

Dezenas de idiomas, detectados automaticamente

Inglês, espanhol, português, francês, alemão, japonês, chinês, coreano, árabe, russo e muitos mais. Forneça uma sugestão de idioma para trechos curtos.

Texto legível e pontuado

Frases, pontuação e quebras de parágrafo em pausas — não um bloco de palavras em minúsculas.

Marcas de tempo para legendas

Cada resposta inclui segmentos marcados por tempo; a API pode adicionar marcas de tempo no nível de palavra para legendas SRT ou VTT.

Privado por design

O reconhecimento é executado em servidores operados pelo ParseJet. O áudio é processado em memória e descartado assim que a transcrição é retornada.

Mesmo mecanismo via API

Um POST com o arquivo, JSON de volta. SDKs para Python e JavaScript, 300 créditos grátis por mês.

Casos de uso

Cenários comuns onde esta ferramenta economiza seu tempo.

Entrevistas e podcasts

Transforme uma hora de conversa em texto pesquisável e citável para artigos, notas de episódio e pesquisa.

Reuniões e ligações

Transcreva a gravação e depois cole em Claude ou ChatGPT para gerar atas e itens de ação.

Aulas e memorandos de voz

Gravações de aula ou ideias capturadas na hora se tornam notas que você pode pesquisar e editar.

Legendas e acessibilidade

Use os segmentos marcados por tempo para criar legendas ou publique a transcrição junto com o áudio.

Automatize com a API

Use a mesma ferramenta de forma programática. Funciona com qualquer linguagem — apenas HTTP.

cURL
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM)
curl -X POST https://api.parsejet.com/v1/parse/audio \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en" \
  -F "with_timestamps=true"

# Response: text + metadata.segments [{start, end, text}] + metadata.words
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/audio",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("interview.mp3", "rb")},
    data={"with_timestamps": "true"},
    timeout=600,
)
data = resp.json()
print(data["text"])                       # the transcript
for seg in data["metadata"]["segments"]:  # timed segments for captions
    print(f'{seg["start"]:.1f}s  {seg["text"]}')
JavaScript
const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");

const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

Quer automatizar isso?

A ParseJet API oferece o mesmo poder de análise através de um único endpoint HTTP. Sem ffmpeg, sem poppler, sem tesseract — apenas uma chamada de API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Ler Documentação da API

Perguntas frequentes

Como faço para transcrever um arquivo de áudio em texto?

Solte a gravação acima e aguarde um momento; a transcrição aparece abaixo da caixa e você pode copiá-la. Nenhuma conta é necessária para as três primeiras transcrições por dia. Para lotes, envie os arquivos para /v1/parse/audio.

Quanto tempo pode ter a gravação?

Até 5 minutos de áudio por requisição e 25 MB por arquivo. Para gravações mais longas, divida-as (a maioria dos editores consegue cortar em silêncios) e transcreva as partes — a API retorna marcas de tempo, então os trechos se alinham.

Quais idiomas são suportados?

Dezenas, incluindo inglês, espanhol, português, francês, alemão, italiano, holandês, polonês, russo, turco, árabe, japonês, coreano e chinês. O idioma é detectado automaticamente; uma sugestão (language=pt) ajuda em trechos muito curtos.

Qual é a precisão da transcrição?

Fala clara de um ou dois falantes é transcrita com alta precisão, incluindo pontuação. Ruído de fundo intenso, conversas simultâneas e sotaques cerrados reduzem a precisão. Áudio descomprimido ou de alta taxa de bits não ajuda muito — a clareza da fala é mais importante que o formato do arquivo.

Posso obter legendas (SRT) da transcrição?

A resposta inclui segmentos marcados por tempo, e with_timestamps=true adiciona marcas de tempo de palavras, que é tudo que um arquivo SRT ou VTT precisa. Um download de legendas em um clique está no roteiro.

Minha gravação é enviada para terceiros?

Não. O reconhecimento de fala é executado nos próprios servidores do ParseJet com modelos de código aberto. Arquivos grandes são comprimidos no seu navegador antes do envio, e o áudio é descartado assim que a transcrição é retornada.

É grátis?

Sim. Três transcrições grátis por dia sem cadastro. Uma transcrição custa 3 créditos (até 5 minutos de áudio); a conta gratuita inclui 300 créditos por mês. Planos pagos começam em $19/mês.

Comece a extrair texto gratuitamente

Sem necessidade de cadastro. Analise seu primeiro arquivo em segundos.

Ver Preços