أداة تحويل الكلام لنص مجانية عبر الإنترنت

ارفع ملفاً، سجل من الميكروفون، أو الصق رابط. الذكاء الاصطناعي يحول في ثوانٍ.

يعمل مع الصوت والفيديو المتاحين للجمهور. لا يدعم المحتوى المحمي بـ DRM.

تحسين نظام الإدارة المتكاملة
محضر خاص
الدردشة مع النص
فكّ قفل الـ Pro →
اسقط الملف هنا أو انقر للتصفح
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM - حتى ٢ غيغابايت
تحسين نظام الإدارة المتكاملة
محضر خاص
الدردشة مع النص
فكّ قفل الـ Pro →
تحسين نظام الإدارة المتكاملة
التسجيل: 0:00
الزمن الحقيقي الشمع (الفوري)
معززة )دقة(
وصلات عامة: 24 ساعة، نص فقط · انضم 7د + سمعية · المؤيدون للوصلات الخاصة

تحويل الكلام إلى نص في الوقت الحقيقي. يقوم الذكاء الاصطناعي بالتصحيح التلقائي بينما تتحدث - تتحسن الدقة مع طول الكلام.

اختبار ميكروفونك أولاً
❤️ أحببت STT.ai؟ أخبر أصدقائك!
لقد استخدمت نسخك المجانية

انضم مجاناً للحصول على 600 دقيقة، أو رفع من $5/شهر لآلاف أكثر.

10 دقائق حرة/يوم 600 دقيقة مجانية مع التسجيل لا توجد بطاقة ائتمان مشفرة
انضم مجاناً →
أكثر من 100 لغة
اكتشاف تلقائي أو اختيار يدوي. جميع اللغات الرئيسية مدعومة.
اكتشاف المتحدثين
يحدد تلقائياً من قال ماذا.
التشفير من جانب العميل
شفر النصوص في متصفحك. حتى نحن لا نستطيع قراءتها.
6 صيغ تصدير
TXT، SRT، VTT، DOCX، JSON، PDF.

صيغ الصوت والفيديو المدعومة

MP3 WAV M4A FLAC OGG MP4 MKV MOV WebM AVI AAC OPUS WMA

ارفع ملفات حتى 2 جيجابايت. ندعم أيضاً أكثر من 1,300 منصة — فقط الصق الرابط. عرض جميع المنصات →

يعمل مع الصوت والفيديو المتاحين للجمهور. لا يدعم المحتوى المحمي بـ DRM.

كيف يعمل

1

ارفع أو سجل

ارفع ملف صوتي/فيديو، الصق رابط من YouTube أو أي منصة، أو سجل من الميكروفون.

2

الذكاء الاصطناعي يحول

اختر من عدة نماذج ذكاء اصطناعي. اكتشاف تلقائي للغة. تحديد المتحدثين يعرف من قال ماذا.

3

صدر وشارك

حمّل كـ TXT، SRT، VTT، DOCX، JSON أو PDF. شارك برابط. حسّن بالذكاء الاصطناعي لدقة أعلى.

الأسئلة الشائعة

نسخة يجري في متصفحك: لصق URL، تحميل ملف، أو تسجيل من ميكروفونك. STT.ai يختار نموذج AI ويعيد النص في أقل من 5 دقائق. تصدير ك TXT، SRT، VTT، DOCX، JSON، أو PDF.

نعم — كل زائر يحصل على 600 دقيقة مجانية للبدء على STT.ai، ويمكن استخدامها ل نسخة مثل أي تدفق عمل آخر. الخطط المدفوعة التي تبدأ من $5/شهر تفتح الملفات الأطول، والنسخ الخاصة، وقائمة الانتظار ذات الأولوية.

نسخة يعمل على نفس نماذج الذكاء الاصطناعي مثل بقية STT.ai - أفضل نماذجنا تصل إلى 95-97% دقة على الكلام النظيف (3-5% معدل خطأ الكلمات على المعايير المرجعية). تغيير النماذج في الهواء مباشرة إذا كانت المرة الأولى أقل من هدفك.

نسخة يمكن أن يعمل على أي من STT.ai 10+ النماذج - STT.ai Enhanced (أكثر دقة)، و Whisper Large V3 (99 لغات)، و NVIDIA Canary (#1 WER على الدعم langs)، و Whisper Turbo (سريع)، و Moonshine (خفيف الوزن)، وأكثر.

نعم، كل نسخة مصدرة في شكل SRT أو VTT - يعمل مع يوتيوب، فيميو، تيك توك، VLC، وكل مشغل الفيديو الرئيسي. أداة تسجيل النصوص الفرعية تغطيهم على الفيديو كترجمات شفوية.

نعم، تقوم خدمة تسجيل المتحدثين تلقائياً بوضع علامات على كل صوت (المتحدث 1، المتحدث 2،...) ويمكنك إعادة تسميتها في المحرر المتكامل، وهي تعمل عبر جميع النماذج واللغات.

معظم نسخة الأعمال تنتهي في أقل من 5 دقائق. ملف صوت لمدة ساعة واحدة عادة ما ينتهي في 2-3 دقائق مع أسرع نماذجنا. السرعة تعتمد على النموذج المختار وحمل وحدة المعالجة الرسومية الحالية.

نسخة يقبل أكثر من 20 صيغة — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, وغيرها. الخرج إلى TXT, SRT, VTT, DOCX, JSON, أو PDF.

نعم. الملفات الصوتية المقدمة إلى نسخة يتم معالجتها وحذفها بشكل افتراضي. الخطط المهنية تضيف تشفير جانب العميل - حتى لو تم اختراق قاعدة بيانات STT.ai، نسختك غير قابلة للقراءة بدون مفتاحك. البيانات لا تستخدم أبدا لتدريب النموذج دون اختيار صريح.

نعم. STT.ai يقدم REST API مع Python و Node.js SDKs، بالإضافة إلى خادم MCP لـ Claude و Cursor - كلها قابلة للاستخدام لـ نسخة تدفقات العمل.

نعم، كل نسخة من النص تفتح في محرر متكامل حيث يمكنك تصحيح الكلمات، وإعادة تسمية المتكلمين، وتعديل الختم الزمني، وإضافة ملاحظات. جميع التغييرات يتم حفظها تلقائياً.

تصدير إلى DOCX أو PDF للبريد الإلكتروني. خطط Pro تضاف كلمة المرور المحمية والروابط الدائمة - مفيدة لعمل العميل.

STT.ai يتعامل مع 1300+ منصات بما في ذلك يوتيوب، فيميو، تيك توك، SoundCloud، Zoom، Google Meet، مضيفي البث، وأكثر.