Transcription audio en texte
Téléchargez un enregistrement et obtenez une transcription claire et ponctuée en quelques secondes. ParseJet transcrit les fichiers MP3, WAV, M4A, OGG, FLAC et WebM avec une reconnaissance vocale qui s'exécute sur nos propres serveurs – des dizaines de langues, détection automatique de la langue, segments chronométrés pour les sous-titres. Gratuit à l'essai, sans inscription ; la même transcription est disponible via l'API.
Déposez un fichier ici ou parcourir
Accepte les fichiers MP3,WAV,M4A,OGG,FLAC,WEBM,AAC
Gratuit — 3 requêtes/jour, pas d'inscription. pour 300 crédits/mois gratuits.
Comment ça marche
Téléchargez votre audio
Déposez n'importe quel enregistrement ci-dessus – mémo vocal, entretien, cours magistral, appel. Les fichiers volumineux sont d'abord comprimés dans votre navigateur, donc même un WAV de 40 Mo s'envoie en secondes.
Reconnaissance vocale
La langue est détectée automatiquement et la parole est transcrite sur les serveurs de ParseJet – rien n'est envoyé à un service d'IA tiers.
Copiez votre transcription
Copiez le texte dans vos notes, vos documents ou un prompt. Les développeurs obtiennent le même résultat sous forme JSON avec des horodatages de segments et de mots.
Fonctionnalités clés
Ce qui distingue ce audio to text.
Tous les formats audio courants
MP3, WAV, M4A, OGG, FLAC, WebM et AAC – directement depuis un téléphone, un enregistreur, une DAW ou un outil de réunion.
Des dizaines de langues, détection automatique
Anglais, espagnol, portugais, français, allemand, japonais, chinois, coréen, arabe, russe et bien d'autres. Passez un indice de langue pour les courtes pistes.
Texte lisible et ponctué
Phrases, ponctuation et sauts de paragraphe aux pauses – pas un mur de mots en minuscules.
Horodatages pour les sous-titres
Chaque réponse inclut des segments chronométrés ; l'API peut ajouter des horodatages au niveau des mots pour les sous-titres SRT ou VTT.
Privé par conception
La reconnaissance s'exécute sur les serveurs que ParseJet exploite. L'audio est traité en mémoire et supprimé une fois la transcription retournée.
Même moteur via l'API
Un POST avec le fichier, JSON en retour. SDK Python et JavaScript, 300 crédits gratuits par mois.
Cas d'utilisation
Scénarios courants où cet outil vous fait gagner du temps.
Entretiens et podcasts
Transformez une heure de conversation en texte consultable et citationnable pour les articles, les notes d'émission et la recherche.
Réunions et appels
Transcrivez l'enregistrement, puis collez-le dans Claude ou ChatGPT pour les procès-verbaux et les éléments d'action.
Cours et mémos vocaux
Les enregistrements de cours ou les idées capturées rapidement deviennent des notes que vous pouvez rechercher et modifier.
Sous-titres et accessibilité
Utilisez les segments chronométrés pour produire des sous-titres ou publier la transcription aux côtés de l'audio.
Automatiser avec l'API
Utilisez le même outil de manière programmatique. Fonctionne avec n'importe quel langage — juste du HTTP.
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM) curl -X POST https://api.parsejet.com/v1/parse/audio \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" \ -F "language=en" \ -F "with_timestamps=true" # Response: text + metadata.segments [{start, end, text}] + metadata.words
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/audio",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("interview.mp3", "rb")},
data={"with_timestamps": "true"},
timeout=600,
)
data = resp.json()
print(data["text"]) # the transcript
for seg in data["metadata"]["segments"]: # timed segments for captions
print(f'{seg["start"]:.1f}s {seg["text"]}') const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");
const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
method: "POST",
headers: { Authorization: "Bearer YOUR_API_KEY" },
body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments); Vous voulez automatiser cela ?
L'API ParseJet vous offre la même puissance d'analyse via un seul point de terminaison HTTP. Pas de ffmpeg, poppler ou tesseract — juste un appel API.
Questions fréquentes
Comment transcrire un fichier audio en texte ?
Déposez l'enregistrement ci-dessus et attendez un moment ; la transcription apparaît sous la zone et vous pouvez la copier. Aucun compte n'est nécessaire pour les trois premières transcriptions par jour. Pour les lots, envoyez les fichiers à /v1/parse/audio.
Quelle peut être la durée de l'enregistrement ?
Jusqu'à 5 minutes d'audio par demande et 25 Mo par fichier. Pour les enregistrements plus longs : divisez-les (la plupart des éditeurs peuvent couper au silence) et transcrivez les parties – l'API retourne des horodatages, donc les pièces s'alignent.
Quelles langues sont supportées ?
Des dizaines, dont l'anglais, l'espagnol, le portugais, le français, l'allemand, l'italien, le néerlandais, le polonais, le russe, le turc, l'arabe, le japonais, le coréen et le chinois. La langue est détectée automatiquement ; un indice (language=fr) aide sur les très courtes pistes.
Quelle est la précision de la transcription ?
La parole claire d'un ou deux locuteurs se transcrit avec une grande précision, y compris la ponctuation. Le bruit de fond important, les chevauchements et les accents forts la réduisent. L'audio non compressé ou haut débit n'aide pas beaucoup – la clarté de la parole importe plus que le format du fichier.
Puis-je obtenir des sous-titres (SRT) à partir de la transcription ?
La réponse inclut des segments chronométrés, et with_timestamps=true ajoute des horodatages de mots, ce qui est tout ce dont un fichier SRT ou VTT a besoin. Un téléchargement de sous-titre en un clic est en cours de développement.
Mon enregistrement est-il envoyé à un tiers ?
Non. La reconnaissance vocale s'exécute sur les serveurs de ParseJet avec des modèles open-source. Les fichiers volumineux sont d'abord comprimés dans votre navigateur, et l'audio est supprimé une fois la transcription retournée.
Est-ce gratuit ?
Oui. Trois transcriptions gratuites par jour sans inscription. Une transcription coûte 3 crédits (jusqu'à 5 minutes d'audio) ; le compte gratuit inclut 300 crédits par mois. Les forfaits payants commencent à 19 $/mois.
Outils associés
MP3 to Text Converter
Convert MP3 to text online for free. Upload an audio file and get an accurate transcript in seconds. MP3, WAV, M4A, OGG, FLAC — or transcribe via API.
WAV to Text Converter
Convert WAV to text online for free. Upload a WAV recording and get an accurate AI transcript in seconds — or transcribe audio at scale via the API.
M4A to Text Converter
Convert M4A to text online for free. Transcribe iPhone Voice Memos and M4A recordings into accurate text in seconds — or automate it via the API.
Video to Text — Transcribe Any Video
Transcribe a video to text online for free. Upload MP4, MOV, MKV, WebM or AVI and get an accurate transcript with timestamps — processed in your browser and on our servers, no signup.
Commencez à extraire du texte gratuitement
Aucune inscription requise. Analysez votre premier fichier en quelques secondes.