ParseJet

Audio ke Teks — Transkrip Audio Apa Saja

Upload rekaman dan dapatkan transkrip yang bersih dan terpunktuasi dalam hitungan detik. ParseJet mentranskrip MP3, WAV, M4A, OGG, FLAC dan WebM dengan pengenalan ucapan yang berjalan di server kami sendiri — puluhan bahasa, deteksi bahasa otomatis, segmen berkala waktu untuk subtitle. Gratis untuk dicoba, tanpa pendaftaran; transkrip yang sama tersedia melalui API.

Letakkan file di sini atau telusuri

Menerima file MP3,WAV,M4A,OGG,FLAC,WEBM,AAC

Gratis — 3 permintaan/hari, tanpa pendaftaran. untuk 300 kredit/bulan gratis.

Cara kerjanya

1

Upload audio Anda

Lepaskan rekaman apa pun di atas — memo suara, wawancara, kuliah, panggilan. File besar dikompres di browser Anda terlebih dahulu, jadi bahkan WAV 40 MB terupload dalam hitungan detik.

2

Pengenalan ucapan

Bahasa terdeteksi otomatis dan ucapan ditranskripsi di server ParseJet — tidak ada yang dikirim ke layanan AI pihak ketiga.

3

Salin transkrip Anda

Salin teks ke catatan, dokumen, atau prompt. Developer mendapatkan hasil yang sama sebagai JSON dengan timestamp segmen dan kata.

Fitur utama

Apa yang membuat audio to text ini menonjol.

Setiap format audio umum

MP3, WAV, M4A, OGG, FLAC, WebM dan AAC — langsung dari ponsel, perekam, DAW, atau alat rapat.

Puluhan bahasa, terdeteksi otomatis

Inggris, Spanyol, Portugis, Prancis, Jerman, Jepang, Mandarin, Korea, Arab, Rusia dan banyak lagi. Berikan petunjuk bahasa untuk klip pendek.

Teks yang dapat dibaca dan terpunktuasi

Kalimat, tanda baca, dan henti paragraf di jeda — bukan dinding kata-kata huruf kecil.

Cap waktu untuk subtitle

Setiap respons mencakup segmen berkala waktu; API dapat menambahkan waktu tingkat kata untuk subtitle SRT atau VTT.

Pribadi menurut desain

Pengenalan berjalan di server yang dioperasikan ParseJet. Audio diproses dalam memori dan dibuang setelah transkrip dikembalikan.

Mesin yang sama melalui API

Satu POST dengan file, JSON kembali. SDK Python dan JavaScript, 300 kredit gratis per bulan.

Kasus penggunaan

Skenario umum di mana alat ini menghemat waktu Anda.

Wawancara dan podcast

Ubah satu jam percakapan menjadi teks yang dapat dicari dan dapat dikutip untuk artikel, catatan pertunjukan, dan penelitian.

Rapat dan panggilan

Transkripsi rekaman, kemudian tempel ke Claude atau ChatGPT untuk notulen dan item tindakan.

Kuliah dan memo suara

Rekaman dari kelas atau ide yang ditangkap dengan cepat menjadi catatan yang dapat Anda cari dan edit.

Subtitle dan aksesibilitas

Gunakan segmen berkala waktu untuk menghasilkan subtitle, atau publikasikan transkrip bersama audio.

Otomatisasi dengan API

Gunakan alat yang sama secara terprogram. Bekerja dengan bahasa apa pun — cukup HTTP.

cURL
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM)
curl -X POST https://api.parsejet.com/v1/parse/audio \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en" \
  -F "with_timestamps=true"

# Response: text + metadata.segments [{start, end, text}] + metadata.words
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/audio",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("interview.mp3", "rb")},
    data={"with_timestamps": "true"},
    timeout=600,
)
data = resp.json()
print(data["text"])                       # the transcript
for seg in data["metadata"]["segments"]:  # timed segments for captions
    print(f'{seg["start"]:.1f}s  {seg["text"]}')
JavaScript
const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");

const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

Ingin mengotomatiskan ini?

ParseJet API memberikan kemampuan parsing yang sama melalui satu endpoint HTTP. Tanpa ffmpeg, tanpa poppler, tanpa tesseract — cukup satu panggilan API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Baca Dokumentasi API

Pertanyaan yang sering diajukan

Bagaimana cara mentranskrip file audio ke teks?

Lepaskan rekaman di atas dan tunggu sebentar; transkrip muncul di bawah kotak dan Anda dapat menyalinnya. Tidak ada akun yang diperlukan untuk tiga transkrip pertama per hari. Untuk batch, POST file ke /v1/parse/audio.

Berapa lama rekamanannya bisa terjadi?

Hingga 5 menit audio per permintaan dan 25 MB per file. Rekaman lebih lama: pisahkan (sebagian besar editor dapat memotong pada keheningan) dan transkripsi bagian-bagiannya — API mengembalikan cap waktu, jadi potongannya sesuai.

Bahasa mana yang didukung?

Puluhan, termasuk Inggris, Spanyol, Portugis, Prancis, Jerman, Italia, Belanda, Polandia, Rusia, Turki, Arab, Jepang, Korea dan Mandarin. Bahasa terdeteksi otomatis; petunjuk (language=es) membantu klip yang sangat pendek.

Seberapa akurat transkripsinya?

Ucapan yang jelas dari satu atau dua pembicara ditranskripsi dengan akurasi tinggi, termasuk tanda baca. Kebisingan latar belakang yang berat, crosstalk, dan aksen tebal menurunkannya. Audio yang tidak terkompresi atau bitrate tinggi tidak membantu banyak — kejelasan ucapan lebih penting daripada format file.

Bisakah saya mendapatkan subtitle (SRT) dari transkrip?

Respons mencakup segmen berkala waktu, dan with_timestamps=true menambahkan waktu kata, yang merupakan semua yang dibutuhkan file SRT atau VTT. Unduhan subtitle sekali klik ada di roadmap.

Apakah rekaman saya diunggah ke pihak ketiga?

Tidak. Pengenalan ucapan berjalan di server ParseJet sendiri dengan model open-source. File besar dikompres di browser Anda sebelum unggah, dan audio dibuang setelah transkrip dikembalikan.

Apakah gratis?

Ya. Tiga transkrip gratis per hari tanpa pendaftaran. Transkrip biaya 3 kredit (hingga 5 menit audio); paket gratis mencakup 300 kredit per bulan. Paket berbayar dimulai dari $19/bulan.

Mulai ekstraksi teks secara gratis

Tidak perlu mendaftar. Parse file pertama Anda dalam hitungan detik.

Lihat Harga