AI નીતિ અને પારદર્શકતા
આપણે કઈ એઆઈનો ઉપયોગ કરીએ છીએ, ક્યાં તે ચાલે છે અને અમે જાહેર કરવાની જરૂરિયાતોનું પાલન કેવી રીતે કરીએ છીએ (યુરોપિયન યુનિયન એઆઈ એક્ટ કલમ 50, 2026-08-02થી અમલી)?
TL;DR
- બધા ટ્રાન્સક્રિપ્ટ AI-જનરેટ થયેલ છે. દરેક આઉટપુટ મશીન-વાંચી શકાય તેવું જાહેરાત કરે છે.
- બધા AI અમારા પોતાના GPU પર ચાલે છે. અમે તમારો ઓડિયો અથવા લખાણ OpenAI, Anthropic, Google, અથવા કોઈપણ ત્રીજી પાર્ટી LLM API ને મોકલતા નથી.
- અમે તમારા ટ્રાન્સક્રિપ્ટ પર કોઈપણ મોડેલને તાલીમ આપતા નથી. દરેક મોડેલ જે અમે ચલાવીએ છીએ તે ઓફ-ધ-શેલ્ફ ઓપન-સોર્સ મોડેલ છે. તમે સ્પષ્ટ રીતે કરેલ સુધારાઓ માત્ર ત્યારે જ એકત્રિત થાય છે જો તમે તેમાં પસંદ કરો.
- સંશ્લેષિત અવાજ ક્લોન (TTS) એ ફાઇલનામ, મેટાડેટા, અને પાના પર AI-જનરેટ થયેલ તરીકે સ્પષ્ટ રીતે લેબલ થયેલ છે.
મોડેલો જે આપણે વાપરીએ છીએ
| મોડેલ | માટે વપરાય છે | લાઇસન્સ | ઉપર ચલાવે છે |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | લખાણ (મૂળભૂત) | MIT | અમારો GPU |
| Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced” | લખાણ (પૈસા ચૂકવેલ યોજનાઓ) | MIT | અમારો GPU |
| Vosk | વાક્ય સ્ટ્રીમિંગ | Apache 2.0 | અમારો GPU |
| SpeechBrain ECAPA-TDNN | સ્પીકર ડાયરીકરણ | Apache 2.0 | અમારો GPU |
| MadLAD-400 3B | ભાષાંતર (૪૫૦+ ભાષાઓ) | Apache 2.0 | અમારો GPU |
| Qwen2.5-1.5B (llama.cpp) | સાર, વિશ્લેષણ, સમાવિષ્ટ ઉત્પન્ન, RAG વાતચીત | Apache 2.0 | અમારો GPU |
| F5-TTS | અવાજ ક્લોનિંગ / લખાણ-થી-ભાષણ | MIT | અમારો GPU |
| all-MiniLM-L6-v2 | RAG શોધ માટે જડિત | Apache 2.0 | અમારો GPU |
“STT.ai Enhanced” એ Whisper large-v3 માટે અમારું ઉત્પાદન નામ છે જે આપણા પોતાના GPU પર ચાલે છે. તે વૈવિધ્યપૂર્ણ મોડેલ નથી, એક ફાઇન-ટ્યુન, અથવા માલિકી વજન નથી - તે સૌથી મોટું અને સૌથી ચોક્કસ Whisper ચકાસણીબિંદુ છે. તે મૂળભૂત Whisper large-v3-turbo કરતા વધુ ચોક્કસ છે, અને રોજગાર પર 1.5x ધીમી છે, આપણા પોતાના હાર્ડવેરમાં માપવામાં આવે છે.
અમે કોઈપણ લક્ષણ માટે OpenAI, Anthropic, Google Cloud, અથવા કોઈપણ ત્રીજી-પક્ષ LLM API ને બોલાવીએ છીએ. ઉપરના દરેક મોડેલ હાર્ડવેરમાં ચાલે છે જે અમારી માલિકીની છે અને સંચાલિત કરે છે. અમે વાપરેલી ફક્ત બાહ્ય AI સેવા UI શબ્દોનું ભાષાંતર કરવા માટે translateapi.ai (અને Muddy Holdings) છે - આ તમારી અનુવાદિત સામગ્રીને ક્યારેય સ્પર્શે નહિં.
આપણે એઆઈ પેઢીને કેવી રીતે જાહેર કરીએ છીએ
- HTML પાનાંઓનું અનુવાદ: <meta name=\ સમાવે છે
- લખાણ નિકાસ (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): દરેક ફાઇલની ટોચ પર 'AI-જનરેટ થયેલ ટ્રાન્સક્રિપ્ટ' હેડર વાક્ય સમાવે છે.
- સંયોજિત અવાજ / TTS આઉટપુટ: WAV ફાઇલો મેટાડેટામાં'synthetic-voice' ટેગ સમાવે છે અને ડાઉનલોડ પાના પર સ્પષ્ટ નોંધણી. અવાજવાળી નિરાકરણ માર્ગદર્શિકા પર છે.
- API જવાબો: _ai_generated: true ક્ષેત્રને દરેક JSON જવાબમાં સમાવે છે કે જે અનુવાદિત સમાવિષ્ટો સમાવે છે.
તાલીમ માહિતી
- આધાર મોડેલો (Whisper, MadLAD, Qwen, વગેરે) તેમના અનુક્રમિત પ્રકાશકોમાંથી પહેલાથી તાલીમ થયેલ આવે છે. અમે તેમને શિપ કરેલ તરીકે વાપરીએ છીએ.
- તમારા ટ્રાન્સક્રિપ્ટ્સ આધાર મોડેલોને તાલીમ આપવા માટે વપરાય છે નહિં.
- જો તમે ટ્રાન્સક્રિપ્ટ સેગમેન્ટ (પેન્સિલ ચિહ્ન) ને સુધારો અથવા તેને ખોટી ચિહ્નિત કરો (ફ્લેગ ચિહ્ન), અને તમે /privacy-settings/ પર પસંદ કર્યું છે ("મૉડેલ ટ્રેનિંગ" બદલો, મૂળભૂત બંધ), (ખોટું લખાણ → સુધારેલ લખાણ) જોડી ભવિષ્યના લખાણ-સુધારા મોડેલને તાલીમ આપવા માટે એકત્રિત કરી શકાય છે. ફક્ત લખાણ જોડી - ક્યારેય આસપાસના ઓડિયો - આ માર્ગ દ્વારા વપરાય છે. આજે આવા કોઈ મોડેલ નથી: જોડીઓ ફક્ત સંગ્રહાયેલ છે, અને અમે હાલમાં જે કંઈપણ સેવા આપીએ છીએ તે તેમના પર તાલીમ આપવામાં આવ્યું છે.
- અલગ, સંપાદનો અને ઓડિયો વૉઇસ લેબમાં પ્રદાન કરો ટોગલ (/privacy-settings/ પર પણ, મૂળભૂત બંધ પણ) તમે CC-BY-SA-4.0 ની અંદર અમારા વૉઇસ લેબ ડેટાસેટમાં સુધારેલ લખાણ સાથે જોડાયેલ, તમે સુધારેલા સેગમેન્ટોના ઓડિયો પ્રદાન કરવા માટે પસંદ કરો. બે ટોગલ સ્વતંત્ર છે - તમે કોઈપણ, બંને, અથવા કોઈપણને પણ પરવાનગી આપી શકો છો.
- ઓડિયો તમે અપલોડ કરો તે cleanup_uploads cron વડે ૨૪ કલાકની અંદર કાઢી નાંખવામાં આવે છે - UNLESS તમે \ ને પસંદ કરો
ચોકસાઈ અને ભૂલો
AI અનુવાદ સંપૂર્ણ નથી. શબ્દ ભૂલ દરો બોલનાર ઉચ્ચાર, ઓડિયો ગુણવત્તા, ભાષા, અને ડોમેઇન શબ્દકોશ દ્વારા બદલાય છે. મહત્વપૂર્ણ વપરાશ માટે (કાયદાકીય, તબીબી, નિયંત્રિત ઉદ્યોગો) મૂળ ઓડિયો સામે ચકાસો. અમારા જાહેર WER બેન્ચમાર્ક મોડેલ પ્રતિ છે /models/.
અનુરૂપતા પ્રશ્નો
યુરોપિયન યુનિયન એઆઈ એક્ટ, જીડીપીઆર અથવા અન્ય અનુરૂપતા પ્રશ્નો માટે: hello@stt.ai અથવા વાપરો સંપર્ક ફોર્મ.
છેલ્લે સુધારેલ: 2026-08-05.