ParseJet

Аудио в текст — Транскрибируйте любую запись

Загрузите запись и получите чистый, пунктуированный текст за секунды. ParseJet распознаёт MP3, WAV, M4A, OGG, FLAC и WebM с помощью речевого движка, работающего на наших собственных серверах — десятки языков, автоматическое определение языка, временные отметки для субтитров. Бесплатно, без регистрации; тот же результат доступен через API для разработчиков.

Перетащите файл сюда или выберите

Принимает файлы MP3,WAV,M4A,OGG,FLAC,WEBM,AAC

Бесплатно — 3 запроса/день, без регистрации. для 300 кредитов/месяц бесплатно.

Как это работает

1

Загрузите аудиофайл

Перетащите любую запись — голосовое сообщение, интервью, лекцию, звонок. Большие файлы сжимаются в вашем браузере, поэтому даже 40 МБ WAV загружается за секунды.

2

Речевое распознавание

Язык определяется автоматически, и речь транскрибируется на серверах ParseJet — данные не отправляются на сторонние сервисы AI.

3

Скопируйте транскрипцию

Скопируйте текст в заметки, документы или промпт. Разработчики получат тот же результат в виде JSON с временными метками для каждого сегмента и слова.

Ключевые особенности

Что отличает этот audio to text.

Все популярные форматы аудио

MP3, WAV, M4A, OGG, FLAC, WebM и AAC — прямо с телефона, диктофона, DAW или приложения для видеозвонков.

Десятки языков, определение автоматическое

Английский, испанский, португальский, французский, немецкий, японский, китайский, корейский, арабский, русский и многие другие. Укажите язык для коротких отрывков.

Читаемый, пунктуированный текст

Предложения, пунктуация и разрывы абзацев в местах пауз — не сплошной текст в нижнем регистре.

Временные метки для субтитров

Каждый ответ содержит помеченные по времени сегменты; API может добавить временные метки на уровне слов для SRT или VTT.

Приватность по умолчанию

Распознавание работает на наших серверах. Аудио обрабатывается в памяти и удаляется сразу после возврата текста.

Тот же движок через API

Один POST с файлом — и JSON в ответ. Доступны SDK для Python и JavaScript, 300 бесплатных кредитов в месяц.

Примеры использования

Типичные сценарии, где этот инструмент экономит ваше время.

Интервью и подкасты

Превратите час беседы в поиск и поиск текста для статей, описаний эпизодов и исследований.

Встречи и звонки

Транскрибируйте запись и вставьте её в Claude или ChatGPT для протокола и плана действий.

Лекции и голосовые заметки

Записи с занятий или идеи, записанные на ходу, становятся заметками, которые можно искать и редактировать.

Субтитры и доступность

Используйте временные отметки для создания субтитров или опубликуйте текст рядом с аудио.

Автоматизируйте с помощью API

Используйте тот же инструмент программно. Работает с любым языком — только HTTP.

cURL
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM)
curl -X POST https://api.parsejet.com/v1/parse/audio \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en" \
  -F "with_timestamps=true"

# Response: text + metadata.segments [{start, end, text}] + metadata.words
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/audio",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("interview.mp3", "rb")},
    data={"with_timestamps": "true"},
    timeout=600,
)
data = resp.json()
print(data["text"])                       # the transcript
for seg in data["metadata"]["segments"]:  # timed segments for captions
    print(f'{seg["start"]:.1f}s  {seg["text"]}')
JavaScript
const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");

const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

Хотите автоматизировать это?

ParseJet API предоставляет те же возможности парсинга через один HTTP-эндпоинт. Никакого ffmpeg, poppler или tesseract — всего один вызов API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Читать документацию API

Часто задаваемые вопросы

Как мне транскрибировать аудиофайл в текст?

Перетащите запись выше и подождите момент — текст появится ниже. Первые три транскрипции в день бесплатны без регистрации. Для больших объёмов используйте POST к /v1/parse/audio.

Какой максимальной длины может быть запись?

До 5 минут аудио на запрос и до 25 МБ на файл. Для более длинных записей разделите их (большинство редакторов режут по паузам) и транскрибируйте части — API возвращает временные метки, поэтому части совпадут.

Какие языки поддерживаются?

Десятки, включая английский, испанский, португальский, французский, немецкий, итальянский, нидерландский, польский, русский, турецкий, арабский, японский, корейский и китайский. Язык определяется автоматически; подсказка (language=es) помогает на очень коротких отрывках.

Насколько точна транскрипция?

Чистая речь одного или двух говорящих транскрибируется с высокой точностью, включая пунктуацию. Сильный фоновый шум, перекрытие речи и сильный акцент снижают точность. Несжатое или высокопоточное аудио не помогает — важнее чистота речи, чем формат файла.

Могу ли я получить субтитры (SRT) из текста?

Ответ содержит помеченные по времени сегменты, и with_timestamps=true добавляет временные метки слов — всё необходимое для файла SRT или VTT. Загрузка субтитров в один клик в дорожной карте.

Загружается ли моя запись на третьи стороны?

Нет. Распознавание речи работает на наших серверах с открытыми моделями. Большие файлы сжимаются в вашем браузере перед загрузкой, и аудио удаляется после возврата текста.

Это бесплатно?

Да. Три бесплатные транскрипции в день без регистрации. Транскрипция стоит 3 кредита (до 5 минут аудио); бесплатный тариф включает 300 кредитов в месяц. Платные тарифы начинаются с $19/месяц.

Начните извлекать текст бесплатно

Регистрация не требуется. Обработайте первый файл за секунды.

Посмотреть тарифы