NVIDIA Canary
STT.ai हे नमूने चालवत नाही. हे पान त्याविषयी संदर्भ माहिती आहे.
आपण चालवतो त्या मॉडेलसह ट्रान्सक्रिप्शन करा →
3.5%
WER
4
भाषाName
45.0x
वेग
CC-BY-4.0
परवाना
विषयी NVIDIA Canary
एनव्हीडिया कॅनरी हे एक 1B पैरामीटर मॉडेल आहे जे इंग्रजी, जर्मन, फ्रेंच आणि स्पॅनिश भाषांतरनासाठी उत्कृष्ट आहे. NeMo चौकटीवर बनविलेले, ते एक ट्रान्सफॉर्मर डिकोडरसह फास्टकॉन्फर्मर एनकोडरचा वापर करते आणि स्वचालित भाषा शोध आणि अनुवादाला समर्थन देते.
नमूना माहिती
- पुरवठाकर्ताNVIDIA
- आर्किटेक्चर-
- परवानाCC-BY-4.0
- अद्ययावतMar 2026
वारंवार विचारले जाणारे प्रश्न
NVIDIA Canary हे NVIDIA द्वारे वार्ता- ते- पाठ्य मॉडेल आहे. STT.ai सध्या NVIDIA Canary चालवत नाही - हे पान मॉडेलविषयी संदर्भ माहिती आहे. STT.ai वरील लिप्यंतरण करीता, मॉडेल निवडकर्ता Whisper कुटुंब (Turbo, मोठे V3, मध्यम, लहान) प्रदान करतो.
NVIDIA Canary% शब्द त्रुटी दर मानक बेंचमार्कवर, NVIDIA Canary प्राप्त करते. वास्तविक विश्वातील अचूकता ऑडिओ गुणवत्ता, उच्चार आणि भाषावर अवलंबून असते; गडबड किंवा उच्चारलेल्या रेकॉर्डिंगसाठी, काही टक्के अधिक WER ची अपेक्षा करा.
NVIDIA Canary STT.ai वर उपलब्ध नाही. त्याची स्वतःची परवाना शर्ती स्वतः चालविण्यासाठी नियमन करते. STT.ai च्या मोफत स्तरावर आम्ही चालविलेल्या व्हिस्पर मॉडेल समाविष्ट आहेत - सुरू करण्यासाठी 600 मिनिट, त्यानंतर एक महिन्याचा मोफत टॉप-अप.
NVIDIA Canary CC-BY-4.0 अंतर्गत जारी केले आहे, एक अनुमती मुक्त-स्रोत परवाना. आपण स्वतःच्या हार्डवेअरवर NVIDIA Canary स्वयं-होस्ट करू शकता किंवा आमच्या होस्ट केलेल्या आवृत्ती वापरू शकता - दोन्ही व्यावसायिक वापरासाठी आहेत.
NVIDIA Canary 4 भाषांना समर्थन देतो. स्वयं-शोधने बहुतेक ऑडिओ करीता योग्य भाषा निवडते; तुम्ही थोडी अचूकता वाढविण्याकरीता स्वतःच ते निश्चित करू शकता.
NVIDIA Canary ऑडिओ प्रक्रिया आपल्या GPU वर 45.0x वास्तविक वेळेत करते. 1 तास ऑडिओ फाइल 1 मिनिटांच्या आत पूर्ण होते; लांब फाइल कतार आणि पूर्ण झाल्यावर ईमेल द्वारे सूचना.
NVIDIA Canary मध्ये 1B पैरामीटर आहेत. मोठे मॉडेल अधिक अचूक पण मंद असतात; STT.ai GPU वर NVIDIA Canary चे यजमान आहे त्यामुळे पैरामीटरची संख्या तुमच्या क्लाऐंट-साइड कार्यक्षमतेवर परिणाम करत नाही.
NVIDIA Canary प्रत्येक स्वरूप स्वीकारते STT.ai समर्थन — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, आणि इतर. आऊटपुट TXT, SRT, VTT, DOCX, JSON, किंवा PDF म्हणून.
NVIDIA Canary प्रत्येक प्रतीसाठी स्पीकर डायराइजेशन सोबत चालते - प्रत्येक स्पीकर लेबल केले जाते आणि आपण संपादकात नंतर त्यांना पुनर्नामांकित करू शकता.
NVIDIA Canary आमच्या व्यवस्थापित वातावरणात चालते - ऑडिओ प्रक्रिया आणि मुलभूतरित्या काढून टाकली जाते आणि स्पष्टपणे निवडल्याशिवाय प्रशिक्षणासाठी कधीही वापरले जात नाही. प्रो योजना स्थिर ट्रान्सक्रिप्टसाठी क्लायंट-साइड एन्क्रिप्शन जोडते.
NVIDIA Canary विरुद्ध इतर कोणत्याही समर्थित मॉडेलवर तेच ऑडिओ चालविण्यासाठी तुलना-stt साधन वापरा - तुम्हाला WER, खंडांची संख्या, स्पीकर लेबल आणि विश्वासार्हता गुण पाहायचे आहेत. NVIDIA Canary विरुद्ध Whisper Large V3 तुलना सर्वात सामान्यपणे चालविली जाते.
होय. /v1/transcribe endpoint वर मॉडेल परिमाण म्हणून "nvidia-canary" निर्देशित करा. Python आणि Node.js SDKs मध्ये NVIDIA Canary उदाहरणे समाविष्ट आहेत. मोफत API स्तरात 100 मिनिट / महिन्याचा समावेश आहे.
होय. NVIDIA Canary हे CC-BY-4.0-लाइसेन्स्ड आहे, म्हणून तुम्ही ते स्वतःच होस्ट करू शकता. STT.ai चे ओपन सोर्स पान प्रकल्प रेपो आणि वजनांची यादी दर्शवते. बहुतेक उत्पादन संघ GPU खरेदी, मॉडेल स्वॅप्स आणि ऑप्स सोडण्यासाठी आमची होस्ट केलेली आवृत्ती वापरतात.