تحويل الصوت إلى نص — تفريغ أي تسجيل
حمّل تسجيلاً واحصل على نسخة منقوطة وسليمة في ثوانٍ. يفرّغ ParseJet ملفات MP3 و WAV و M4A و OGG و FLAC و WebM باستخدام تقنية التعرف على الكلام التي تعمل على خوادمنا الخاصة — عشرات اللغات، كشف اللغة التلقائي، مقاطع موقتة للترجمات. مجاني للتجربة، بدون تسجيل؛ نفس الخدمة متاحة أيضاً عبر API للمطورين.
أسقط ملفًا هنا أو تصفح
يقبل ملفات MP3,WAV,M4A,OGG,FLAC,WEBM,AAC
مجاني — 3 طلبات/يوم، بدون تسجيل. للحصول على 300 رصيد/شهر مجانًا.
كيف يعمل
حمّل صوتك
أفلت أي تسجيل — رسالة صوتية أو مقابلة أو محاضرة أو مكالمة. يتم ضغط الملفات الكبيرة في متصفحك أولاً، لذا حتى ملف WAV بحجم 40 ميجابايت يُحمّل في ثوانٍ.
التعرف على الكلام
يتم اكتشاف اللغة تلقائياً والتعرف على الكلام على خوادم ParseJet — لا نرسل شيئاً لخدمة ذكاء اصطناعي تابعة لطرف ثالث.
انسخ نسختك
انسخ النص إلى الملاحظات أو المستندات أو موجه الأوامر. المطورون يحصلون على نفس النتيجة كـ JSON مع طوابع زمنية للمقاطع والكلمات.
الميزات الرئيسية
ما الذي يجعل audio to text هذا مميزًا.
كل صيغ الصوت الشائعة
MP3 و WAV و M4A و OGG و FLAC و WebM و AAC — مباشرة من الهاتف أو المسجل أو محطة الإنتاج أو أداة الاجتماعات.
عشرات اللغات، كشف تلقائي
الإنجليزية والإسبانية والبرتغالية والفرنسية والألمانية واليابانية والصينية والكورية والعربية والروسية وغيرها. أضف تلميح لغة للمقاطع القصيرة.
نص نظيف ومنقوط
جمل وعلامات ترقيم وفقرات في فواصل الصمت — لا كتلة من الكلمات بحروف صغيرة.
طوابع زمنية للترجمات
تتضمن كل استجابة مقاطع موقتة؛ يمكن للـ API إضافة طوابع زمنية على مستوى الكلمات لملفات SRT أو VTT.
خصوصية بالتصميم
يعمل التعرف على الخوادم التي تشغلها ParseJet. يتم معالجة الصوت في الذاكرة والتخلص منه بعد إرجاع النسخة.
نفس المحرك عبر API
إرسالة واحدة بالملف، JSON في الرد. SDKs متاحة للـ Python و JavaScript، 300 ائتمان مجاني شهرياً.
حالات الاستخدام
سيناريوهات شائعة حيث يوفر لك هذا الأداة الوقت.
المقابلات والبودكاست
حوّل ساعة من الحديث إلى نص قابل للبحث والاقتباس منه للمقالات وملاحظات البرنامج والبحث.
الاجتماعات والمكالمات
فرّغ التسجيل ثم ألصقه في Claude أو ChatGPT للحصول على المحاضر والمهام.
المحاضرات والرسائل الصوتية
التسجيلات من الفصل أو الأفكار الملتقطة في الطريق تصبح ملاحظات قابلة للبحث والتحرير.
الترجمات وإمكانية الوصول
استخدم المقاطع الموقتة لإنتاج ترجمات، أو انشر النسخة بجانب الصوت.
أتمتة باستخدام الـ API
استخدم نفس الأداة برمجيًا. يعمل مع أي لغة — مجرد HTTP.
# Transcribe a recording (MP3, WAV, M4A, OGG, FLAC, WebM) curl -X POST https://api.parsejet.com/v1/parse/audio \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" \ -F "language=en" \ -F "with_timestamps=true" # Response: text + metadata.segments [{start, end, text}] + metadata.words
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/audio",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("interview.mp3", "rb")},
data={"with_timestamps": "true"},
timeout=600,
)
data = resp.json()
print(data["text"]) # the transcript
for seg in data["metadata"]["segments"]: # timed segments for captions
print(f'{seg["start"]:.1f}s {seg["text"]}') const formData = new FormData();
formData.append("file", audioFile); // MP3, WAV, M4A, OGG, FLAC, WebM
formData.append("with_timestamps", "true");
const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
method: "POST",
headers: { Authorization: "Bearer YOUR_API_KEY" },
body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments); هل تريد أتمتة هذا؟
ParseJet API تمنحك نفس قوة التحليل عبر نقطة نهاية HTTP واحدة. لا ffmpeg، لا poppler، لا tesseract — مجرد استدعاء API واحد.
الأسئلة الشائعة
كيف أفرّغ ملف صوتي إلى نص؟
أفلت التسجيل أعلاه وانتظر لحظة؛ تظهر النسخة أسفل الصندوق ويمكنك نسخها. لا يُطلب حساب للتفريغ الثلاثة الأولى يومياً. للدفعات، أرسل الملفات إلى /v1/parse/audio.
ما أقصى مدة للتسجيل؟
حتى 5 دقائق صوتية لكل طلب و 25 ميجابايت لكل ملف. للتسجيلات الأطول: قسّمها (معظم محررات الصوت تقطع على الصمت) وفرّغ الأجزاء — يعيد API الطوابع الزمنية، لذا تتوافق الأجزاء.
ما اللغات المدعومة؟
عشرات، منها الإنجليزية والإسبانية والبرتغالية والفرنسية والألمانية والإيطالية والهولندية والبولندية والروسية والتركية والعربية واليابانية والكورية والصينية. يتم الكشف عن اللغة تلقائياً؛ التلميح (language=es) يساعد على المقاطع القصيرة جداً.
ما دقة التفريغ؟
الكلام الواضح من متحدث واحد أو اثنين يُفرّغ بدقة عالية، بما في ذلك الترقيم. الضوضاء الخلفية الثقيلة والتداخل واللهجات الثقيلة تقللها. الصوت غير المضغوط أو عالي معدل البت لا يساعد كثيراً — وضوح الكلام أهم من صيغة الملف.
هل يمكنني الحصول على ترجمات (SRT) من النسخة؟
تتضمن الاستجابة مقاطع موقتة، و with_timestamps=true يضيف طوابع زمنية للكلمات، وهو كل ما يحتاجه ملف SRT أو VTT. تحميل ترجمات بنقرة واحدة في خارطة الطريق.
هل يُرفع تسجيلي إلى طرف ثالث؟
لا. يعمل التعرف على الكلام على خوادم ParseJet الخاصة بنا مع نماذج مفتوحة المصدر. يتم ضغط الملفات الكبيرة في متصفحك قبل التحميل، والصوت يُحذف بعد إرجاع النسخة.
هل هو مجاني؟
نعم. ثلاثة تفريغات مجانية يومياً بدون تسجيل. التفريغ يكلف 3 أرصدة (حتى 5 دقائق صوت)؛ الحساب المجاني يتضمن 300 رصيد شهرياً. الخطط المدفوعة تبدأ من 19$ شهرياً.
أدوات ذات صلة
MP3 to Text Converter
Convert MP3 to text online for free. Upload an audio file and get an accurate transcript in seconds. MP3, WAV, M4A, OGG, FLAC — or transcribe via API.
WAV to Text Converter
Convert WAV to text online for free. Upload a WAV recording and get an accurate AI transcript in seconds — or transcribe audio at scale via the API.
M4A to Text Converter
Convert M4A to text online for free. Transcribe iPhone Voice Memos and M4A recordings into accurate text in seconds — or automate it via the API.
Video to Text — Transcribe Any Video
Transcribe a video to text online for free. Upload MP4, MOV, MKV, WebM or AVI and get an accurate transcript with timestamps — processed in your browser and on our servers, no signup.