)ب( اﻻستنتاجات SenseVoice
5.5%
WER
50
اللغات
50.0x
السرعة
MIT
الترخيص
حول SenseVoice
SenseVoice هو نموذج لقاعدة الكلام من FunAudioLLM الذي يتجاوز النسخ، وهو يدعم أكثر من 50 لغة ويشمل قدرات التعرف على المشاعر، وكشف الأحداث الصوتية، وتطبيع النص العكسي في نموذج واحد.
اللغات التي تدعمها SenseVoice
معلومات النموذج
- مقدم الخدمةFunAudioLLM
- الهندسة المعمارية-
- الترخيصMIT
- مستكملةMar 2026
الأسئلة الشائعة
STT.ai يستضيف SenseVoice على البنية التحتية لمعالجنا الرسومى لذا يمكنك استخدامه بدون توفير معداتك الخاصة - تحميل الصوت أو الفيديو واختار SenseVoice من خيار النموذج.
على المعايير القياسية، SenseVoice يحقق حوالي 5.5% معدل خطأ الكلمات. تعتمد دقة العالم الحقيقي على جودة الصوت، والهجة، واللغة؛ بالنسبة للتسجيلات المضطربة أو الملفتة، توقع بضع نقاط مئوية أعلى WER.
SenseVoice يعمل على المستوى المجاني لـ STT.ai - كل زائر يحصل على 600 دقيقة للبدء بدون تكلفة.خطط الدفع تضاف حدود أطول لكل ملف، والنسخ الخاصة، وصف الأولوية.
SenseVoice يصدر تحت رخصة MIT، وهي رخصة مفتوحة المصدر متساهلة. يمكنك استضافة SenseVoice على أجهزة الكمبيوتر الخاصة بك أو استخدام نسختنا المستضافة - وكلاهما قابل للاستخدام التجاري.
SenseVoice يدعم 50 لغات. الكشف التلقائي يختار اللغة الصحيحة لمعظم الصوتيات؛ يمكنك أيضا تحديدها يدويا لزيادة الدقة قليلا.
SenseVoice يقوم بمعالجة الصوت بحوالي 50.0x في الوقت الحقيقي على وحدات المعالجة المركزية لدينا. ملف صوت لمدة ساعة واحدة ينتهي في أقل من 1 دقيقة؛ الملفات الأطول توضع في صف وتخطر بالبريد الإلكتروني عند الانتهاء.
النماذج الأكبر تميل إلى أن تكون أكثر دقة ولكنها أبطأ؛ STT.ai تستضيف SenseVoice على وحدة المعالجة المركزية الرسومية بحيث لا يؤثر عدد البارامترات على أداء جانب العميل.
SenseVoice يقبل كل صيغة STT.ai يدعمها - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, وغيرها.خرج TXT, SRT, VTT, DOCX, JSON, أو PDF.
نعم، تشغيل تسجيل المتحدثين إلى جانب SenseVoice لكل نسخة - كل متحدث يحمل علامة ويمكنك إعادة تسميتهم في المحرر بعد ذلك.
نعم. SenseVoice تشغيل في بيئتنا المدارة - الصوت يتم معالجتها وحذفها تلقائيا ولا تستخدم أبدا للتدريب دون اختيار صريح في. الخطط المهنية تضاف تشفير جانب العميل للنصوص في حالة الاستراحة.
استخدم أداة compare-stt لتشغيل SenseVoice ضد أي نموذج مدعوم آخر على نفس الصوت - سترى WER، عدد القطاعات، علامات المتحدث، وعلامات الثقة جنبًا إلى جنب.
نعم. حدد "sensevoice" كبارامترات النموذج على نقطة النهاية /v1/transcribe. تتضمن مجموعات برامج تطوير التطبيقات للغة بايثون ولغة نود.جي.اس أمثلة للغة SenseVoice.
نعم، لأن SenseVoice مرخصة من قبل MIT، يمكنك استضافتها بنفسك. صفحة المصدر المفتوح لـ STT.ai تتضمن قائمة بمشروع إعادة تخزين المشروع وأوزانه. معظم فرق الإنتاج تستخدم نسختنا المستضافة لتجاوز شراء وحدة المعالجة الرسومية، ومبادلات النماذج، والعمليات.