Distil-Whisper

STT.ai does not run this model. This page is reference information about it. हम जो मॉडल चलाते हैं के साथ एहसान एहसान पत्र →
5.8%
WER
99
भाषाएँ
48.0x
गति
MIT
लाइसेंस

के बारे में Distil-Whisper

Dinging चेहरे द्वारा बनाई गई थी. यह पैटर्न आकार को कम करता है 49% द्वारा बनाया गया है और 1% के भीतर बनाए रखने के दौरान 6x तेजी से प्राप्त करता है। मूल serv2 बड़े वी2 की जाँच सेट पर।
मॉडल जानकारी
  • प्रदाताHugging Face
  • स्फीति-
  • लाइसेंसMIT
  • अद्यतन किया गयाMar 2026

अक्सर पूछे जाने वाले प्रश्न

Distil-Whisper is a speech-to-text model by Hugging Face. STT.ai does not currently run Distil-Whisper — this page is reference information about the model. For transcription on STT.ai, the model picker offers the Whisper family (Turbo, Large V3, Medium, Small).

On standard benchmarks, Distil-Whisper achieves around 5.8% Word Error Rate. Real-world accuracy depends on audio quality, accent, and language; for noisy or accented recordings, expect a few percentage points higher WER.

Distil-Whisper 4,000 पर उपलब्ध नहीं है. इसके लाइसेंस के अपने खुद का आदेश यह खुद चल रहा है. STT.ai मुक्त मॉडल हम चलाने के लिए तैयार है - 600 मिनट शुरू करने के लिए, फिर एक मासिक मुक्त शीर्ष.

Distil-Whisper को MIT के तहत रिहा किया गया है, एक गलत खुले स्रोत लाइसेंस. आप अपने स्वयं को H-host000 पर कर सकते हैं या हमारे मेजबानित संस्करण का उपयोग कर सकते हैं - दोनों व्यावसायिक रूप से प्रयोग कर रहे हैं.

Distil-Whisper 99 भाषाओं का समर्थन करता है. स्वचालित रूप से ध्वनि के लिए सही भाषा लेता है; आप इसे दस्ती रूप से निर्दिष्ट कर सकते हैं एक छोटी सी सटीकता के लिए.

Distil-Whisper प्रक्रियाओं के बारे में 48.0x वास्तविक समय हमारे जीपी. एक 1 घंटे की ध्वनि फ़ाइल 1 मिनट में होती है, अब फ़ाइलें कतार में और ईमेल द्वारा सूचना देता है.

Distil-Whisper में 8800 पैरामीटर हैं. बड़ा मॉडल अधिक सही होने की पुष्टि करता है लेकिन धीमी; STT.ai सेना Distil-Whisper GUCHU पर तो पैरामीटर नंबर अपने ग्राहक किनारे प्रदर्शन को प्रभावित नहीं करता.

Distil-Whisper हर प्रारूप STT.ai समर्थन स्वीकार करता है — एमपी3, एम.4A, ओ.ए.

वक्‍ता ने हर भाषण के लिए Distil-Whisper लोगों के पास दौड़ता है — हर वक्‍ता पर लेबल लगाया जाता है और बाद में इन्हें संपादक में बदल सकता है ।

जी. Distil-Whisper हमारे सफल वातावरण में चला जाता है — ऑडियो को डिफ़ॉल्ट रूप से संसाधित किया जाता है और उसे मिटाया नहीं जाता बिना विशिष्ट स्तर के प्रशिक्षण के लिए प्रयोग किया जाता है.

एक ही ऑडियो के खिलाफ किसी भी अन्य समर्थित मॉडल को चलाने के लिए Distil-Whisper उपकरण का उपयोग करें - आप Werer, खण्ड गिनती, स्पीकरों, और अंक के विपरीत देखें। Distil-Whisper v3 बड़ा V3 तुलना आम तौर पर चल रहा है।

हाँ. "8000" मॉडल का मूल्य के रूप में निर्दिष्ट करें /v1/टैक्स अंत बिन्दु पर. पायथन और नोड शामिल है Distil-Whisper उदाहरण.

हाँ. क्योंकि Distil-Whisper है MIT-कैम्प्ड, आप यह खुद से शुरू कर सकते हैं. STT.ai के खुले स्रोत पृष्ठ सूची परियोजना रीपोस और वजन. अधिकांश उत्पादन टीमों का उपयोग GUpon, मॉडलpon, मॉडल की मात्रा छोड़ देने के लिए किया गया संस्करण, और ops.