आयटी धोरण आणि पारदर्शकता

आपण काय वापरतो, कुठे चालतो आणि आम्ही खुलासा आवश्यकता कशी पूर्ण करतो (युरोपियन युनियन एआय कायदा कलम 50, प्रभावी 2026-08-02).

TL;DR

  • सर्व प्रकारच्या शस्त्रक्रिया, सर्व प्रकारच्या उपचारांसाठी शस्त्रक्रिया केंद्रे, सर्व प्रकारच्या शस्त्रक्रियांसाठी शस्त्रक्रिया केंद्रे, सर्व प्रकारच्या शस्त्रक्रियांसाठी शस्त्रक्रिया केंद्रे इ.
  • सर्व AI आपल्या स्वतःच्या GPU वर चालते. आम्ही तुमचे ऑडिओ किंवा पाठ्य OpenAI, Anthropic, Google, किंवा कोणत्याही तृतीय पक्ष LLM API ला पाठवत नाही.
  • आम्ही तुमच्या लिखित स्वरूपावर आधार मॉडेल प्रशिक्षण देत नाही. फक्त एक निवडा-इन fine-tune वापरते तुम्ही स्पष्टपणे केले सुधारणे.
  • ॲरिस्टॉटलच्या तत्त्वज्ञानात तत्त्वज्ञान म्हणजे तत्त्वज्ञानाच्या आधारावर मांडलेले विचार, तत्त्वज्ञान म्हणजे तत्त्वज्ञानाच्या आधारावर मांडलेले विचार.

आपण वापरलेले नमुने

मॉडेलकरीता वापरले जातेपरवानावर चालविले जाते
Whisper large-v3-turbo (faster-whisper)ट्रान्सक्रिप्शन (मासिक)MITआमचे GPU
STT.ai Enhanced (custom fine-tune)Transcription (paid plans)MIT (base) / Proprietary (fine-tune weights)आमचे GPU
Voskवास्तविक-वेळ शब्द प्रवाहApache 2.0आमचे GPU
SpeechBrain ECAPA-TDNNस्पीकर डायराइजेशनApache 2.0आमचे GPU
MadLAD-400 3Bअनुवाद (450+ भाषा) NameApache 2.0आमचे GPU
Qwen2.5-1.5B (llama.cpp)वृत्तपत्रे,Apache 2.0आमचे GPU
F5-TTSआवाज क्लोन / पाठ्य- ते- बोलणेMITआमचे GPU
all-MiniLM-L6-v2RAG शोध करीता अंतर्भूतीतNameApache 2.0आमचे GPU

आम्ही ओपनएआय, एंथ्रोपिक, गुगल क्लाउड, किंवा कोणत्याही वैशिष्ट्यासाठी कोणत्याही तृतीय पक्ष एलएलएम एपीआयला कॉल करत नाही. वरील प्रत्येक मॉडेल हार्डवेअरवर चालते जे आम्ही मालकीचे आणि कार्यरत आहोत. आम्ही वापरत असलेल्या केवळ बाह्य एआय सेवा translateapi.ai (आणि मुडी होल्डिंग्स) यूआय स्ट्रिंग्सचे भाषांतर करण्यासाठी आहे - हे कधीही तुमच्या लिखित सामग्रीला स्पर्श करत नाही.

ॲपल कंपनीचे संकेतस्थळ

  • HTML पानांचे ट्रान्सक्रिप्ट करा: < meta name=\ समाविष्ट करा
  • पाठ्य एक्सपोर्ट (TXT, SRT, VTT, JSON, CSV, DOCX, PDF) Name: प्रत्येक फाइलच्या वरील बाजूस 'AI-जनरेटड ट्रान्सक्रिप्ट' हेडर लाइन समाविष्ट करा.
  • सिंथेटिक आवाज / TTS आऊटपुट: WAV फाइल्स मेटाडेटा मध्ये 'सिंथेटिक- आवाज' टॅग समाविष्टीत आहे व डाउनलोड पानावर स्पष्ट सूचना आहे. ऑडिबल निवारक मार्गदर्शकावर आहे.
  • API प्रतिसाद: प्रत्येक JSON प्रतिसादात _ai_generated: true क्षेत्र समाविष्ट करा ज्यात संपादीत विषयवस्तु समाविष्ट आहे.

प्रशिक्षण माहिती

  • आधारभूत नमुने (Whisper, MadLAD, Qwen, इत्यादी) त्यांच्या संबंधित प्रकाशकांकडून पूर्व- प्रशिक्षण प्राप्त करतात. आम्ही त्यांना शिपिंगप्रमाणे वापरतो.
  • याचे कारण म्हणजे, त्याचे वजन कमी करण्यासाठी त्याचे वजन कमी करणे आवश्यक आहे.
  • जर तुम्ही एक ट्रान्सक्रिप्ट भाग (पेन चिन्ह) सुधारले किंवा ते चुकीचे चिन्हांकित केले (फ्लेग चिन्ह), आणि तुम्ही /privacy-settings/ (\
  • वेगळ्या प्रकारे, Contribute corrections plus audio to Voice Lab toggle (/privacy-settings/ येथेही, पूर्वनिर्धारित बंद) तुम्ही CC-BY-SA-4.0 अंतर्गत आमच्या Voice Lab डेटासेटमध्ये तुम्ही सुधारलेल्या भागांचे ऑडिओ योगदान देण्यासाठी निवडा, सुधारित पाठ्यसह जोडलेले. दोन्ही टॉगल स्वतंत्र आहेत - तुम्ही एक, दोन्ही किंवा दोन्ही देऊ शकता.
  • तुम्ही अपलोड केलेले ऑडिओ cleanup_ uploads cron द्वारे २४ तासांच्या आत नष्ट केले जाते — तुम्ही निवडले नसल्यास \

अचूकता व त्रुटी

AI ट्रान्सक्रिप्शन पूर्णतया पूर्ण नाही. शब्द त्रुटी दर स्पीकर उच्चार, ऑडिओ गुणवत्ता, भाषा, व क्षेत्र शब्दकोशानुसार बदलतात. महत्वाच्या वापरासाठी (कानूनी, वैद्यकीय, नियामक उद्योग) मूळ ऑडिओशी तुलना करा. आमचे सार्वजनिक WER बेंचमार्क प्रति मॉडेल येथे आहेत /models/.

अनुरूपता प्रश्न

युरोपियन युनियनच्या एआय कायद्याबाबत, जीडीपीआर किंवा इतर अनुपालन प्रश्नांसाठी: hello@stt.ai किंवा वापरा संपर्क फॉर्म.

शेवटचे अद्ययावत: 2026-04-26.