आयटी धोरण आणि पारदर्शकता
आपण काय वापरतो, कुठे चालतो आणि आम्ही खुलासा आवश्यकता कशी पूर्ण करतो (युरोपियन युनियन एआय कायदा कलम 50, प्रभावी 2026-08-02).
TL;DR
- सर्व प्रकारच्या शस्त्रक्रिया, सर्व प्रकारच्या उपचारांसाठी शस्त्रक्रिया केंद्रे, सर्व प्रकारच्या शस्त्रक्रियांसाठी शस्त्रक्रिया केंद्रे, सर्व प्रकारच्या शस्त्रक्रियांसाठी शस्त्रक्रिया केंद्रे इ.
- सर्व AI आपल्या स्वतःच्या GPU वर चालते. आम्ही तुमचे ऑडिओ किंवा पाठ्य OpenAI, Anthropic, Google, किंवा कोणत्याही तृतीय पक्ष LLM API ला पाठवत नाही.
- आम्ही तुमच्या लिखित स्वरूपावर आधार मॉडेल प्रशिक्षण देत नाही. फक्त एक निवडा-इन fine-tune वापरते तुम्ही स्पष्टपणे केले सुधारणे.
- ॲरिस्टॉटलच्या तत्त्वज्ञानात तत्त्वज्ञान म्हणजे तत्त्वज्ञानाच्या आधारावर मांडलेले विचार, तत्त्वज्ञान म्हणजे तत्त्वज्ञानाच्या आधारावर मांडलेले विचार.
आपण वापरलेले नमुने
| मॉडेल | करीता वापरले जाते | परवाना | वर चालविले जाते |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | ट्रान्सक्रिप्शन (मासिक) | MIT | आमचे GPU |
| STT.ai Enhanced (custom fine-tune) | Transcription (paid plans) | MIT (base) / Proprietary (fine-tune weights) | आमचे GPU |
| Vosk | वास्तविक-वेळ शब्द प्रवाह | Apache 2.0 | आमचे GPU |
| SpeechBrain ECAPA-TDNN | स्पीकर डायराइजेशन | Apache 2.0 | आमचे GPU |
| MadLAD-400 3B | अनुवाद (450+ भाषा) Name | Apache 2.0 | आमचे GPU |
| Qwen2.5-1.5B (llama.cpp) | वृत्तपत्रे, | Apache 2.0 | आमचे GPU |
| F5-TTS | आवाज क्लोन / पाठ्य- ते- बोलणे | MIT | आमचे GPU |
| all-MiniLM-L6-v2 | RAG शोध करीता अंतर्भूतीतName | Apache 2.0 | आमचे GPU |
आम्ही ओपनएआय, एंथ्रोपिक, गुगल क्लाउड, किंवा कोणत्याही वैशिष्ट्यासाठी कोणत्याही तृतीय पक्ष एलएलएम एपीआयला कॉल करत नाही. वरील प्रत्येक मॉडेल हार्डवेअरवर चालते जे आम्ही मालकीचे आणि कार्यरत आहोत. आम्ही वापरत असलेल्या केवळ बाह्य एआय सेवा translateapi.ai (आणि मुडी होल्डिंग्स) यूआय स्ट्रिंग्सचे भाषांतर करण्यासाठी आहे - हे कधीही तुमच्या लिखित सामग्रीला स्पर्श करत नाही.
ॲपल कंपनीचे संकेतस्थळ
- HTML पानांचे ट्रान्सक्रिप्ट करा: < meta name=\ समाविष्ट करा
- पाठ्य एक्सपोर्ट (TXT, SRT, VTT, JSON, CSV, DOCX, PDF) Name: प्रत्येक फाइलच्या वरील बाजूस 'AI-जनरेटड ट्रान्सक्रिप्ट' हेडर लाइन समाविष्ट करा.
- सिंथेटिक आवाज / TTS आऊटपुट: WAV फाइल्स मेटाडेटा मध्ये 'सिंथेटिक- आवाज' टॅग समाविष्टीत आहे व डाउनलोड पानावर स्पष्ट सूचना आहे. ऑडिबल निवारक मार्गदर्शकावर आहे.
- API प्रतिसाद: प्रत्येक JSON प्रतिसादात _ai_generated: true क्षेत्र समाविष्ट करा ज्यात संपादीत विषयवस्तु समाविष्ट आहे.
प्रशिक्षण माहिती
- आधारभूत नमुने (Whisper, MadLAD, Qwen, इत्यादी) त्यांच्या संबंधित प्रकाशकांकडून पूर्व- प्रशिक्षण प्राप्त करतात. आम्ही त्यांना शिपिंगप्रमाणे वापरतो.
- याचे कारण म्हणजे, त्याचे वजन कमी करण्यासाठी त्याचे वजन कमी करणे आवश्यक आहे.
- जर तुम्ही एक ट्रान्सक्रिप्ट भाग (पेन चिन्ह) सुधारले किंवा ते चुकीचे चिन्हांकित केले (फ्लेग चिन्ह), आणि तुम्ही /privacy-settings/ (\
- वेगळ्या प्रकारे, Contribute corrections plus audio to Voice Lab toggle (/privacy-settings/ येथेही, पूर्वनिर्धारित बंद) तुम्ही CC-BY-SA-4.0 अंतर्गत आमच्या Voice Lab डेटासेटमध्ये तुम्ही सुधारलेल्या भागांचे ऑडिओ योगदान देण्यासाठी निवडा, सुधारित पाठ्यसह जोडलेले. दोन्ही टॉगल स्वतंत्र आहेत - तुम्ही एक, दोन्ही किंवा दोन्ही देऊ शकता.
- तुम्ही अपलोड केलेले ऑडिओ cleanup_ uploads cron द्वारे २४ तासांच्या आत नष्ट केले जाते — तुम्ही निवडले नसल्यास \
अचूकता व त्रुटी
AI ट्रान्सक्रिप्शन पूर्णतया पूर्ण नाही. शब्द त्रुटी दर स्पीकर उच्चार, ऑडिओ गुणवत्ता, भाषा, व क्षेत्र शब्दकोशानुसार बदलतात. महत्वाच्या वापरासाठी (कानूनी, वैद्यकीय, नियामक उद्योग) मूळ ऑडिओशी तुलना करा. आमचे सार्वजनिक WER बेंचमार्क प्रति मॉडेल येथे आहेत /models/.
अनुरूपता प्रश्न
युरोपियन युनियनच्या एआय कायद्याबाबत, जीडीपीआर किंवा इतर अनुपालन प्रश्नांसाठी: hello@stt.ai किंवा वापरा संपर्क फॉर्म.
शेवटचे अद्ययावत: 2026-04-26.