ParseJet

Transcription audio en texte

Téléchargez un enregistrement et obtenez une transcription claire et ponctuée en quelques secondes. ParseJet transcrit les fichiers MP3, WAV, M4A, OGG, FLAC et WebM avec une reconnaissance vocale qui s'exécute sur nos propres serveurs – des dizaines de langues, détection automatique de la langue, segments chronométrés pour les sous-titres. Gratuit à l'essai, sans inscription ; la même transcription est disponible via l'API.

Déposez un fichier ici ou parcourir

Accepte les fichiers MP3,WAV,M4A,OGG,FLAC,WEBM,AAC

Gratuit — 3 requêtes/jour, pas d'inscription. pour 300 crédits/mois gratuits.

Comment ça marche

1

Téléchargez votre audio

Déposez n'importe quel enregistrement ci-dessus – mémo vocal, entretien, cours magistral, appel. Les fichiers volumineux sont d'abord comprimés dans votre navigateur, donc même un WAV de 40 Mo s'envoie en secondes.

2

Reconnaissance vocale

La langue est détectée automatiquement et la parole est transcrite sur les serveurs de ParseJet – rien n'est envoyé à un service d'IA tiers.

3

Copiez votre transcription

Copiez le texte dans vos notes, vos documents ou un prompt. Les développeurs obtiennent le même résultat sous forme JSON avec des horodatages de segments et de mots.

Fonctionnalités clés

Ce qui distingue ce audio to text.

Tous les formats audio courants

MP3, WAV, M4A, OGG, FLAC, WebM et AAC – directement depuis un téléphone, un enregistreur, une DAW ou un outil de réunion.

Des dizaines de langues, détection automatique

Anglais, espagnol, portugais, français, allemand, japonais, chinois, coréen, arabe, russe et bien d'autres. Passez un indice de langue pour les courtes pistes.

Texte lisible et ponctué

Phrases, ponctuation et sauts de paragraphe aux pauses – pas un mur de mots en minuscules.

Horodatages pour les sous-titres

Chaque réponse inclut des segments chronométrés ; l'API peut ajouter des horodatages au niveau des mots pour les sous-titres SRT ou VTT.

Privé par conception

La reconnaissance s'exécute sur les serveurs que ParseJet exploite. L'audio est traité en mémoire et supprimé une fois la transcription retournée.

Même moteur via l'API

Un POST avec le fichier, JSON en retour. SDK Python et JavaScript, 300 crédits gratuits par mois.

Cas d'utilisation

Scénarios courants où cet outil vous fait gagner du temps.

Entretiens et podcasts

Transformez une heure de conversation en texte consultable et citationnable pour les articles, les notes d'émission et la recherche.

Réunions et appels

Transcrivez l'enregistrement, puis collez-le dans Claude ou ChatGPT pour les procès-verbaux et les éléments d'action.

Cours et mémos vocaux

Les enregistrements de cours ou les idées capturées rapidement deviennent des notes que vous pouvez rechercher et modifier.

Sous-titres et accessibilité

Utilisez les segments chronométrés pour produire des sous-titres ou publier la transcription aux côtés de l'audio.

Automatiser avec l'API

Utilisez le même outil de manière programmatique. Fonctionne avec n'importe quel langage — juste du HTTP.

cURL
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM)
curl -X POST https://api.parsejet.com/v1/parse/audio \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en" \
  -F "with_timestamps=true"

# Response: text + metadata.segments [{start, end, text}] + metadata.words
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/audio",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("interview.mp3", "rb")},
    data={"with_timestamps": "true"},
    timeout=600,
)
data = resp.json()
print(data["text"])                       # the transcript
for seg in data["metadata"]["segments"]:  # timed segments for captions
    print(f'{seg["start"]:.1f}s  {seg["text"]}')
JavaScript
const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");

const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

Vous voulez automatiser cela ?

L'API ParseJet vous offre la même puissance d'analyse via un seul point de terminaison HTTP. Pas de ffmpeg, poppler ou tesseract — juste un appel API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Lire la documentation API

Questions fréquentes

Comment transcrire un fichier audio en texte ?

Déposez l'enregistrement ci-dessus et attendez un moment ; la transcription apparaît sous la zone et vous pouvez la copier. Aucun compte n'est nécessaire pour les trois premières transcriptions par jour. Pour les lots, envoyez les fichiers à /v1/parse/audio.

Quelle peut être la durée de l'enregistrement ?

Jusqu'à 5 minutes d'audio par demande et 25 Mo par fichier. Pour les enregistrements plus longs : divisez-les (la plupart des éditeurs peuvent couper au silence) et transcrivez les parties – l'API retourne des horodatages, donc les pièces s'alignent.

Quelles langues sont supportées ?

Des dizaines, dont l'anglais, l'espagnol, le portugais, le français, l'allemand, l'italien, le néerlandais, le polonais, le russe, le turc, l'arabe, le japonais, le coréen et le chinois. La langue est détectée automatiquement ; un indice (language=fr) aide sur les très courtes pistes.

Quelle est la précision de la transcription ?

La parole claire d'un ou deux locuteurs se transcrit avec une grande précision, y compris la ponctuation. Le bruit de fond important, les chevauchements et les accents forts la réduisent. L'audio non compressé ou haut débit n'aide pas beaucoup – la clarté de la parole importe plus que le format du fichier.

Puis-je obtenir des sous-titres (SRT) à partir de la transcription ?

La réponse inclut des segments chronométrés, et with_timestamps=true ajoute des horodatages de mots, ce qui est tout ce dont un fichier SRT ou VTT a besoin. Un téléchargement de sous-titre en un clic est en cours de développement.

Mon enregistrement est-il envoyé à un tiers ?

Non. La reconnaissance vocale s'exécute sur les serveurs de ParseJet avec des modèles open-source. Les fichiers volumineux sont d'abord comprimés dans votre navigateur, et l'audio est supprimé une fois la transcription retournée.

Est-ce gratuit ?

Oui. Trois transcriptions gratuites par jour sans inscription. Une transcription coûte 3 crédits (jusqu'à 5 minutes d'audio) ; le compte gratuit inclut 300 crédits par mois. Les forfaits payants commencent à 19 $/mois.

Commencez à extraire du texte gratuitement

Aucune inscription requise. Analysez votre premier fichier en quelques secondes.

Voir les tarifs