Audio ke Teks — Transkrip Audio Apa Saja
Upload rekaman dan dapatkan transkrip yang bersih dan terpunktuasi dalam hitungan detik. ParseJet mentranskrip MP3, WAV, M4A, OGG, FLAC dan WebM dengan pengenalan ucapan yang berjalan di server kami sendiri — puluhan bahasa, deteksi bahasa otomatis, segmen berkala waktu untuk subtitle. Gratis untuk dicoba, tanpa pendaftaran; transkrip yang sama tersedia melalui API.
Letakkan file di sini atau telusuri
Menerima file MP3,WAV,M4A,OGG,FLAC,WEBM,AAC
Gratis — 3 permintaan/hari, tanpa pendaftaran. untuk 300 kredit/bulan gratis.
Cara kerjanya
Upload audio Anda
Lepaskan rekaman apa pun di atas — memo suara, wawancara, kuliah, panggilan. File besar dikompres di browser Anda terlebih dahulu, jadi bahkan WAV 40 MB terupload dalam hitungan detik.
Pengenalan ucapan
Bahasa terdeteksi otomatis dan ucapan ditranskripsi di server ParseJet — tidak ada yang dikirim ke layanan AI pihak ketiga.
Salin transkrip Anda
Salin teks ke catatan, dokumen, atau prompt. Developer mendapatkan hasil yang sama sebagai JSON dengan timestamp segmen dan kata.
Fitur utama
Apa yang membuat audio to text ini menonjol.
Setiap format audio umum
MP3, WAV, M4A, OGG, FLAC, WebM dan AAC — langsung dari ponsel, perekam, DAW, atau alat rapat.
Puluhan bahasa, terdeteksi otomatis
Inggris, Spanyol, Portugis, Prancis, Jerman, Jepang, Mandarin, Korea, Arab, Rusia dan banyak lagi. Berikan petunjuk bahasa untuk klip pendek.
Teks yang dapat dibaca dan terpunktuasi
Kalimat, tanda baca, dan henti paragraf di jeda — bukan dinding kata-kata huruf kecil.
Cap waktu untuk subtitle
Setiap respons mencakup segmen berkala waktu; API dapat menambahkan waktu tingkat kata untuk subtitle SRT atau VTT.
Pribadi menurut desain
Pengenalan berjalan di server yang dioperasikan ParseJet. Audio diproses dalam memori dan dibuang setelah transkrip dikembalikan.
Mesin yang sama melalui API
Satu POST dengan file, JSON kembali. SDK Python dan JavaScript, 300 kredit gratis per bulan.
Kasus penggunaan
Skenario umum di mana alat ini menghemat waktu Anda.
Wawancara dan podcast
Ubah satu jam percakapan menjadi teks yang dapat dicari dan dapat dikutip untuk artikel, catatan pertunjukan, dan penelitian.
Rapat dan panggilan
Transkripsi rekaman, kemudian tempel ke Claude atau ChatGPT untuk notulen dan item tindakan.
Kuliah dan memo suara
Rekaman dari kelas atau ide yang ditangkap dengan cepat menjadi catatan yang dapat Anda cari dan edit.
Subtitle dan aksesibilitas
Gunakan segmen berkala waktu untuk menghasilkan subtitle, atau publikasikan transkrip bersama audio.
Otomatisasi dengan API
Gunakan alat yang sama secara terprogram. Bekerja dengan bahasa apa pun — cukup HTTP.
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM) curl -X POST https://api.parsejet.com/v1/parse/audio \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" \ -F "language=en" \ -F "with_timestamps=true" # Response: text + metadata.segments [{start, end, text}] + metadata.words
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/audio",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("interview.mp3", "rb")},
data={"with_timestamps": "true"},
timeout=600,
)
data = resp.json()
print(data["text"]) # the transcript
for seg in data["metadata"]["segments"]: # timed segments for captions
print(f'{seg["start"]:.1f}s {seg["text"]}') const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");
const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
method: "POST",
headers: { Authorization: "Bearer YOUR_API_KEY" },
body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments); Ingin mengotomatiskan ini?
ParseJet API memberikan kemampuan parsing yang sama melalui satu endpoint HTTP. Tanpa ffmpeg, tanpa poppler, tanpa tesseract — cukup satu panggilan API.
Pertanyaan yang sering diajukan
Bagaimana cara mentranskrip file audio ke teks?
Lepaskan rekaman di atas dan tunggu sebentar; transkrip muncul di bawah kotak dan Anda dapat menyalinnya. Tidak ada akun yang diperlukan untuk tiga transkrip pertama per hari. Untuk batch, POST file ke /v1/parse/audio.
Berapa lama rekamanannya bisa terjadi?
Hingga 5 menit audio per permintaan dan 25 MB per file. Rekaman lebih lama: pisahkan (sebagian besar editor dapat memotong pada keheningan) dan transkripsi bagian-bagiannya — API mengembalikan cap waktu, jadi potongannya sesuai.
Bahasa mana yang didukung?
Puluhan, termasuk Inggris, Spanyol, Portugis, Prancis, Jerman, Italia, Belanda, Polandia, Rusia, Turki, Arab, Jepang, Korea dan Mandarin. Bahasa terdeteksi otomatis; petunjuk (language=es) membantu klip yang sangat pendek.
Seberapa akurat transkripsinya?
Ucapan yang jelas dari satu atau dua pembicara ditranskripsi dengan akurasi tinggi, termasuk tanda baca. Kebisingan latar belakang yang berat, crosstalk, dan aksen tebal menurunkannya. Audio yang tidak terkompresi atau bitrate tinggi tidak membantu banyak — kejelasan ucapan lebih penting daripada format file.
Bisakah saya mendapatkan subtitle (SRT) dari transkrip?
Respons mencakup segmen berkala waktu, dan with_timestamps=true menambahkan waktu kata, yang merupakan semua yang dibutuhkan file SRT atau VTT. Unduhan subtitle sekali klik ada di roadmap.
Apakah rekaman saya diunggah ke pihak ketiga?
Tidak. Pengenalan ucapan berjalan di server ParseJet sendiri dengan model open-source. File besar dikompres di browser Anda sebelum unggah, dan audio dibuang setelah transkrip dikembalikan.
Apakah gratis?
Ya. Tiga transkrip gratis per hari tanpa pendaftaran. Transkrip biaya 3 kredit (hingga 5 menit audio); paket gratis mencakup 300 kredit per bulan. Paket berbayar dimulai dari $19/bulan.
Alat terkait
MP3 to Text Converter
Convert MP3 to text online for free. Upload an audio file and get an accurate transcript in seconds. MP3, WAV, M4A, OGG, FLAC — or transcribe via API.
WAV to Text Converter
Convert WAV to text online for free. Upload a WAV recording and get an accurate AI transcript in seconds — or transcribe audio at scale via the API.
M4A to Text Converter
Convert M4A to text online for free. Transcribe iPhone Voice Memos and M4A recordings into accurate text in seconds — or automate it via the API.
Video to Text — Transcribe Any Video
Transcribe a video to text online for free. Upload MP4, MOV, MKV, WebM or AVI and get an accurate transcript with timestamps — processed in your browser and on our servers, no signup.
Mulai ekstraksi teks secara gratis
Tidak perlu mendaftar. Parse file pertama Anda dalam hitungan detik.