STT.ai Enhanced

STT.ai हे मॉडेल मोफत स्तरावर चालवते. STT.ai Enhanced नंतरचे मॉडेल आहे. मोफत लिप्यंतरण Whisper Large v3 Turbo वापरते, जे जलद आहे. योजना → · विकिमीडिया कॉमन्सवर टर्की संबंधित संचिका आहेत →
4.2%
WER
99
भाषाName
15.9x
वेग
MIT
परवाना

विषयी STT.ai Enhanced

STT.ai Enhanced हे आमचे सर्वात अचूक आणि जलद भाषण- ते- पाठ्य मॉडेल आहे. मालकीच्या अनुकूलनसह अत्याधुनिक ट्रान्सफॉर्मर आर्किटेक्चरवर बांधलेले, ते 100+ भाषांमधून उद्योग-प्रमुख शब्द त्रुटी दर पुरवते. उत्पादन लिप्यंतरण, वास्तविक-वेळ उपशीर्षक आणि उद्योजक अनुप्रयोगांसाठी आदर्श आहे.
✦ वाढविलेले मॉडेल उघडा

Get access to our most accurate model with any paid plan — Whisper large-v3, 99 languages, and speaker diarization.

योजना पहा →
नमूना माहिती
  • पुरवठाकर्ताOpenAI (hosted by STT.ai)
  • आर्किटेक्चर-
  • परवानाMIT
  • अद्ययावतAug 2026

वारंवार विचारले जाणारे प्रश्न

STT.ai Enhanced is a speech-to-text model by OpenAI (hosted by STT.ai). STT.ai runs it on our own GPU for accounts on a paid plan, and it is the model behind the STT.ai Enhanced tier. Free transcription uses Whisper Large v3 Turbo, the faster checkpoint of the same family.

STT.ai Enhanced% शब्द त्रुटी दर मानक बेंचमार्कवर, STT.ai Enhanced प्राप्त करते. वास्तविक विश्वातील अचूकता ऑडिओ गुणवत्ता, उच्चार आणि भाषावर अवलंबून असते; गडबड किंवा उच्चारलेल्या रेकॉर्डिंगसाठी, काही टक्के अधिक WER ची अपेक्षा करा.

STT.ai Enhanced एक प्रीमियम मॉडेल आहे - $9/ महिन्यात सुरू होणाऱ्या कोणत्याही मोफत STT.ai योजनासह समाविष्ट आहे. ते मोफत स्तरावर उपलब्ध नाही: मोफत आणि अनामिक अपलोड व्हीस्पर टर्बो चालवितात.

STT.ai Enhanced MIT अंतर्गत जारी केले आहे, एक अनुमती मुक्त-स्रोत परवाना. आपण स्वतःच्या हार्डवेअरवर STT.ai Enhanced स्वयं-होस्ट करू शकता किंवा आमच्या होस्ट केलेल्या आवृत्ती वापरू शकता - दोन्ही व्यावसायिक वापरासाठी आहेत.

STT.ai Enhanced 99 भाषांना समर्थन देतो. स्वयं-शोधने बहुतेक ऑडिओ करीता योग्य भाषा निवडते; तुम्ही थोडी अचूकता वाढविण्याकरीता स्वतःच ते निश्चित करू शकता.

STT.ai Enhanced ऑडिओ प्रक्रिया आपल्या GPU वर 15.9x वास्तविक वेळेत करते. 1 तास ऑडिओ फाइल 3 मिनिटांच्या आत पूर्ण होते; लांब फाइल कतार आणि पूर्ण झाल्यावर ईमेल द्वारे सूचना.

STT.ai Enhanced मध्ये 1.55B पैरामीटर आहेत. मोठे मॉडेल अधिक अचूक पण मंद असतात; STT.ai GPU वर STT.ai Enhanced चे यजमान आहे त्यामुळे पैरामीटरची संख्या तुमच्या क्लाऐंट-साइड कार्यक्षमतेवर परिणाम करत नाही.

STT.ai Enhanced प्रत्येक स्वरूप स्वीकारते STT.ai समर्थन — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, आणि इतर. आऊटपुट TXT, SRT, VTT, DOCX, JSON, किंवा PDF म्हणून.

STT.ai Enhanced प्रत्येक प्रतीसाठी स्पीकर डायराइजेशन सोबत चालते - प्रत्येक स्पीकर लेबल केले जाते आणि आपण संपादकात नंतर त्यांना पुनर्नामांकित करू शकता.

STT.ai Enhanced आमच्या खाजगी पायाभूत सुविधा चालते - ऑडिओ प्रक्रिया आणि डिफॉल्टने काढून टाकले जाते. प्रो + क्लायंट-साइड एन्क्रिप्शन जोडते म्हणून ट्रान्सक्रिप्ट आपल्या कुंजीशिवाय वाचता येत नाही, आणि खाजगी क्लाउड तुम्हाला स्वतःच्या VPC मध्ये पूर्णपणे स्व-होस्ट STT.ai Enhanced देते.

STT.ai Enhanced विरुद्ध इतर कोणत्याही समर्थित मॉडेलवर तेच ऑडिओ चालविण्यासाठी तुलना-stt साधन वापरा - तुम्हाला WER, खंडांची संख्या, स्पीकर लेबल आणि विश्वासार्हता गुण पाहायचे आहेत. STT.ai Enhanced विरुद्ध Whisper Large V3 तुलना सर्वात सामान्यपणे चालविली जाते.

होय, मोफत योजनावर. /v1/transcribe endpoint वर मॉडेल परिमाण म्हणून "stt-ai-enhanced" निर्देशीत करा. सक्रीय योजना नसलेल्या किल्लीस Whisper Large v3 Turbo द्वारे सेवा दिली जाते. विनंती अजूनही यशस्वी होते; ते फक्त मोफत मॉडेल चालवते.

होय. STT.ai Enhanced हे MIT-लाइसेन्स्ड आहे, म्हणून तुम्ही ते स्वतःच होस्ट करू शकता. STT.ai चे ओपन सोर्स पान प्रकल्प रेपो आणि वजनांची यादी दर्शवते. बहुतेक उत्पादन संघ GPU खरेदी, मॉडेल स्वॅप्स आणि ऑप्स सोडण्यासाठी आमची होस्ट केलेली आवृत्ती वापरतात.