Distil-Whisper
لا يقوم STT.ai بتشغيل هذا النموذج. هذه الصفحة هي معلومات مرجعية عنها.
نسخة مع النماذج التي نقوم بتشغيلها →
5.8%
WER
99
اللغات
48.0x
السرعة
MIT
الترخيص
حول Distil-Whisper
Distil-Whisper هي نسخة مقطرة من Whisper من صنع Hugging Face. وهي تقلل من حجم النموذج بنسبة 49% وتحقق استنتاجاً أسرع بست مرات بينما تحافظ على 1% من WER من Whisper Large V2 الأصلي على مجموعات التقييم خارج التوزيع.
اللغات التي تدعمها Distil-Whisper
معلومات النموذج
- مقدم الخدمةHugging Face
- الهندسة المعمارية-
- الترخيصMIT
- مستكملةMar 2026
الأسئلة الشائعة
Distil-Whisper هو نموذج تحويل الكلام إلى نص من قبل Hugging Face. STT.ai لا يعمل حاليا Distil-Whisper - هذه الصفحة هي معلومات مرجعية عن النموذج. للنسخ على STT.ai، يقدم اختيار النموذج عائلة Whisper (Turbo، Large V3، Medium، Small).
على المعايير القياسية، Distil-Whisper يحقق حوالي 5.8% معدل خطأ الكلمات. تعتمد دقة العالم الحقيقي على جودة الصوت، والهجة، واللغة؛ بالنسبة للتسجيلات المضطربة أو الملفتة، توقع بضع نقاط مئوية أعلى WER.
Distil-Whisper غير متاح على STT.ai. شروط ترخيصه الخاصة تحكم تشغيله بنفسك. STT.ai المستوى المجاني يغطي نماذج Whisper نحن نعمل - 600 دقيقة للبدء، ثم شهري مجاني تغذية.
Distil-Whisper يصدر تحت رخصة MIT، وهي رخصة مفتوحة المصدر متساهلة. يمكنك استضافة Distil-Whisper على أجهزة الكمبيوتر الخاصة بك أو استخدام نسختنا المستضافة - وكلاهما قابل للاستخدام التجاري.
Distil-Whisper يدعم 99 لغات. الكشف التلقائي يختار اللغة الصحيحة لمعظم الصوتيات؛ يمكنك أيضا تحديدها يدويا لزيادة الدقة قليلا.
Distil-Whisper يقوم بمعالجة الصوت بحوالي 48.0x في الوقت الحقيقي على وحدات المعالجة المركزية لدينا. ملف صوت لمدة ساعة واحدة ينتهي في أقل من 1 دقيقة؛ الملفات الأطول توضع في صف وتخطر بالبريد الإلكتروني عند الانتهاء.
النماذج الأكبر تميل إلى أن تكون أكثر دقة ولكنها أبطأ؛ STT.ai تستضيف Distil-Whisper على وحدة المعالجة المركزية الرسومية بحيث لا يؤثر عدد البارامترات على أداء جانب العميل.
Distil-Whisper يقبل كل صيغة STT.ai يدعمها - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, وغيرها.خرج TXT, SRT, VTT, DOCX, JSON, أو PDF.
نعم، تشغيل تسجيل المتحدثين إلى جانب Distil-Whisper لكل نسخة - كل متحدث يحمل علامة ويمكنك إعادة تسميتهم في المحرر بعد ذلك.
نعم. Distil-Whisper تشغيل في بيئتنا المدارة - الصوت يتم معالجتها وحذفها تلقائيا ولا تستخدم أبدا للتدريب دون اختيار صريح في. الخطط المهنية تضاف تشفير جانب العميل للنصوص في حالة الاستراحة.
استخدم أداة compare-stt لتشغيل Distil-Whisper ضد أي نموذج مدعوم آخر على نفس الصوت - سترى WER، عدد القطاعات، علامات المتحدث، وعلامات الثقة جنبًا إلى جنب.
نعم. حدد "distil-whisper" كبارامترات النموذج على نقطة النهاية /v1/transcribe. تتضمن مجموعات برامج تطوير التطبيقات للغة بايثون ولغة نود.جي.اس أمثلة للغة Distil-Whisper.
نعم، لأن Distil-Whisper مرخصة من قبل MIT، يمكنك استضافتها بنفسك. صفحة المصدر المفتوح لـ STT.ai تتضمن قائمة بمشروع إعادة تخزين المشروع وأوزانه. معظم فرق الإنتاج تستخدم نسختنا المستضافة لتجاوز شراء وحدة المعالجة الرسومية، ومبادلات النماذج، والعمليات.