Distil-Whisper

STT.ai हे नमूने चालवत नाही. हे पान त्याविषयी संदर्भ माहिती आहे. आपण चालवतो त्या मॉडेलसह ट्रान्सक्रिप्शन करा →
5.8%
WER
99
भाषाName
48.0x
वेग
MIT
परवाना

विषयी Distil-Whisper

ॲरिस्टॉटलच्या मते, तत्त्वज्ञान हे एक तत्त्वज्ञान आहे ज्यात तत्त्वज्ञानाच्या सर्वात महत्त्वाच्या घटकांचा समावेश असतो, ज्यात तत्त्वज्ञानाच्या सर्वात महत्त्वाच्या घटकांचा समावेश असतो, ज्यात तत्त्वज्ञानाचा सर्वात महत्त्वाचा घटक म्हणजे तत्त्वज्ञानाचा मूलभूत संकल्पना आणि तत्त्वे आहेत.
नमूना माहिती
  • पुरवठाकर्ताHugging Face
  • आर्किटेक्चर-
  • परवानाMIT
  • अद्ययावतMar 2026

वारंवार विचारले जाणारे प्रश्न

Distil-Whisper हे Hugging Face द्वारे वार्ता- ते- पाठ्य मॉडेल आहे. STT.ai सध्या Distil-Whisper चालवत नाही - हे पान मॉडेलविषयी संदर्भ माहिती आहे. STT.ai वरील लिप्यंतरण करीता, मॉडेल निवडकर्ता Whisper कुटुंब (Turbo, मोठे V3, मध्यम, लहान) प्रदान करतो.

Distil-Whisper% शब्द त्रुटी दर मानक बेंचमार्कवर, Distil-Whisper प्राप्त करते. वास्तविक विश्वातील अचूकता ऑडिओ गुणवत्ता, उच्चार आणि भाषावर अवलंबून असते; गडबड किंवा उच्चारलेल्या रेकॉर्डिंगसाठी, काही टक्के अधिक WER ची अपेक्षा करा.

Distil-Whisper STT.ai वर उपलब्ध नाही. त्याची स्वतःची परवाना शर्ती स्वतः चालविण्यासाठी नियमन करते. STT.ai च्या मोफत स्तरावर आम्ही चालविलेल्या व्हिस्पर मॉडेल समाविष्ट आहेत - सुरू करण्यासाठी 600 मिनिट, त्यानंतर एक महिन्याचा मोफत टॉप-अप.

Distil-Whisper MIT अंतर्गत जारी केले आहे, एक अनुमती मुक्त-स्रोत परवाना. आपण स्वतःच्या हार्डवेअरवर Distil-Whisper स्वयं-होस्ट करू शकता किंवा आमच्या होस्ट केलेल्या आवृत्ती वापरू शकता - दोन्ही व्यावसायिक वापरासाठी आहेत.

Distil-Whisper 99 भाषांना समर्थन देतो. स्वयं-शोधने बहुतेक ऑडिओ करीता योग्य भाषा निवडते; तुम्ही थोडी अचूकता वाढविण्याकरीता स्वतःच ते निश्चित करू शकता.

Distil-Whisper ऑडिओ प्रक्रिया आपल्या GPU वर 48.0x वास्तविक वेळेत करते. 1 तास ऑडिओ फाइल 1 मिनिटांच्या आत पूर्ण होते; लांब फाइल कतार आणि पूर्ण झाल्यावर ईमेल द्वारे सूचना.

Distil-Whisper मध्ये 756M पैरामीटर आहेत. मोठे मॉडेल अधिक अचूक पण मंद असतात; STT.ai GPU वर Distil-Whisper चे यजमान आहे त्यामुळे पैरामीटरची संख्या तुमच्या क्लाऐंट-साइड कार्यक्षमतेवर परिणाम करत नाही.

Distil-Whisper प्रत्येक स्वरूप स्वीकारते STT.ai समर्थन — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, आणि इतर. आऊटपुट TXT, SRT, VTT, DOCX, JSON, किंवा PDF म्हणून.

Distil-Whisper प्रत्येक प्रतीसाठी स्पीकर डायराइजेशन सोबत चालते - प्रत्येक स्पीकर लेबल केले जाते आणि आपण संपादकात नंतर त्यांना पुनर्नामांकित करू शकता.

Distil-Whisper आमच्या व्यवस्थापित वातावरणात चालते - ऑडिओ प्रक्रिया आणि मुलभूतरित्या काढून टाकली जाते आणि स्पष्टपणे निवडल्याशिवाय प्रशिक्षणासाठी कधीही वापरले जात नाही. प्रो योजना स्थिर ट्रान्सक्रिप्टसाठी क्लायंट-साइड एन्क्रिप्शन जोडते.

Distil-Whisper विरुद्ध इतर कोणत्याही समर्थित मॉडेलवर तेच ऑडिओ चालविण्यासाठी तुलना-stt साधन वापरा - तुम्हाला WER, खंडांची संख्या, स्पीकर लेबल आणि विश्वासार्हता गुण पाहायचे आहेत. Distil-Whisper विरुद्ध Whisper Large V3 तुलना सर्वात सामान्यपणे चालविली जाते.

होय. /v1/transcribe endpoint वर मॉडेल परिमाण म्हणून "distil-whisper" निर्देशित करा. Python आणि Node.js SDKs मध्ये Distil-Whisper उदाहरणे समाविष्ट आहेत. मोफत API स्तरात 100 मिनिट / महिन्याचा समावेश आहे.

होय. Distil-Whisper हे MIT-लाइसेन्स्ड आहे, म्हणून तुम्ही ते स्वतःच होस्ट करू शकता. STT.ai चे ओपन सोर्स पान प्रकल्प रेपो आणि वजनांची यादी दर्शवते. बहुतेक उत्पादन संघ GPU खरेदी, मॉडेल स्वॅप्स आणि ऑप्स सोडण्यासाठी आमची होस्ट केलेली आवृत्ती वापरतात.