AI નીતિ અને પારદર્શકતા

આપણે કઈ એઆઈનો ઉપયોગ કરીએ છીએ, ક્યાં તે ચાલે છે અને અમે જાહેર કરવાની જરૂરિયાતોનું પાલન કેવી રીતે કરીએ છીએ (યુરોપિયન યુનિયન એઆઈ એક્ટ કલમ 50, 2026-08-02થી અમલી)?

TL;DR

  • બધા ટ્રાન્સક્રિપ્ટ AI-જનરેટ થયેલ છે. દરેક આઉટપુટ મશીન-વાંચી શકાય તેવું જાહેરાત કરે છે.
  • બધા AI અમારા પોતાના GPU પર ચાલે છે. અમે તમારો ઓડિયો અથવા લખાણ OpenAI, Anthropic, Google, અથવા કોઈપણ ત્રીજી પાર્ટી LLM API ને મોકલતા નથી.
  • અમે તમારા ટ્રાન્સક્રિપ્ટ પર કોઈપણ મોડેલને તાલીમ આપતા નથી. દરેક મોડેલ જે અમે ચલાવીએ છીએ તે ઓફ-ધ-શેલ્ફ ઓપન-સોર્સ મોડેલ છે. તમે સ્પષ્ટ રીતે કરેલ સુધારાઓ માત્ર ત્યારે જ એકત્રિત થાય છે જો તમે તેમાં પસંદ કરો.
  • સંશ્લેષિત અવાજ ક્લોન (TTS) એ ફાઇલનામ, મેટાડેટા, અને પાના પર AI-જનરેટ થયેલ તરીકે સ્પષ્ટ રીતે લેબલ થયેલ છે.

મોડેલો જે આપણે વાપરીએ છીએ

મોડેલમાટે વપરાય છેલાઇસન્સઉપર ચલાવે છે
Whisper large-v3-turbo (faster-whisper)લખાણ (મૂળભૂત)MITઅમારો GPU
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”લખાણ (પૈસા ચૂકવેલ યોજનાઓ)MITઅમારો GPU
Voskવાક્ય સ્ટ્રીમિંગApache 2.0અમારો GPU
SpeechBrain ECAPA-TDNNસ્પીકર ડાયરીકરણApache 2.0અમારો GPU
MadLAD-400 3Bભાષાંતર (૪૫૦+ ભાષાઓ)Apache 2.0અમારો GPU
Qwen2.5-1.5B (llama.cpp)સાર, વિશ્લેષણ, સમાવિષ્ટ ઉત્પન્ન, RAG વાતચીતApache 2.0અમારો GPU
F5-TTSઅવાજ ક્લોનિંગ / લખાણ-થી-ભાષણMITઅમારો GPU
all-MiniLM-L6-v2RAG શોધ માટે જડિતApache 2.0અમારો GPU

“STT.ai Enhanced” એ Whisper large-v3 માટે અમારું ઉત્પાદન નામ છે જે આપણા પોતાના GPU પર ચાલે છે. તે વૈવિધ્યપૂર્ણ મોડેલ નથી, એક ફાઇન-ટ્યુન, અથવા માલિકી વજન નથી - તે સૌથી મોટું અને સૌથી ચોક્કસ Whisper ચકાસણીબિંદુ છે. તે મૂળભૂત Whisper large-v3-turbo કરતા વધુ ચોક્કસ છે, અને રોજગાર પર 1.5x ધીમી છે, આપણા પોતાના હાર્ડવેરમાં માપવામાં આવે છે.

અમે કોઈપણ લક્ષણ માટે OpenAI, Anthropic, Google Cloud, અથવા કોઈપણ ત્રીજી-પક્ષ LLM API ને બોલાવીએ છીએ. ઉપરના દરેક મોડેલ હાર્ડવેરમાં ચાલે છે જે અમારી માલિકીની છે અને સંચાલિત કરે છે. અમે વાપરેલી ફક્ત બાહ્ય AI સેવા UI શબ્દોનું ભાષાંતર કરવા માટે translateapi.ai (અને Muddy Holdings) છે - આ તમારી અનુવાદિત સામગ્રીને ક્યારેય સ્પર્શે નહિં.

આપણે એઆઈ પેઢીને કેવી રીતે જાહેર કરીએ છીએ

  • HTML પાનાંઓનું અનુવાદ: <meta name=\ સમાવે છે
  • લખાણ નિકાસ (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): દરેક ફાઇલની ટોચ પર 'AI-જનરેટ થયેલ ટ્રાન્સક્રિપ્ટ' હેડર વાક્ય સમાવે છે.
  • સંયોજિત અવાજ / TTS આઉટપુટ: WAV ફાઇલો મેટાડેટામાં'synthetic-voice' ટેગ સમાવે છે અને ડાઉનલોડ પાના પર સ્પષ્ટ નોંધણી. અવાજવાળી નિરાકરણ માર્ગદર્શિકા પર છે.
  • API જવાબો: _ai_generated: true ક્ષેત્રને દરેક JSON જવાબમાં સમાવે છે કે જે અનુવાદિત સમાવિષ્ટો સમાવે છે.

તાલીમ માહિતી

  • આધાર મોડેલો (Whisper, MadLAD, Qwen, વગેરે) તેમના અનુક્રમિત પ્રકાશકોમાંથી પહેલાથી તાલીમ થયેલ આવે છે. અમે તેમને શિપ કરેલ તરીકે વાપરીએ છીએ.
  • તમારા ટ્રાન્સક્રિપ્ટ્સ આધાર મોડેલોને તાલીમ આપવા માટે વપરાય છે નહિં.
  • જો તમે ટ્રાન્સક્રિપ્ટ સેગમેન્ટ (પેન્સિલ ચિહ્ન) ને સુધારો અથવા તેને ખોટી ચિહ્નિત કરો (ફ્લેગ ચિહ્ન), અને તમે /privacy-settings/ પર પસંદ કર્યું છે ("મૉડેલ ટ્રેનિંગ" બદલો, મૂળભૂત બંધ), (ખોટું લખાણ → સુધારેલ લખાણ) જોડી ભવિષ્યના લખાણ-સુધારા મોડેલને તાલીમ આપવા માટે એકત્રિત કરી શકાય છે. ફક્ત લખાણ જોડી - ક્યારેય આસપાસના ઓડિયો - આ માર્ગ દ્વારા વપરાય છે. આજે આવા કોઈ મોડેલ નથી: જોડીઓ ફક્ત સંગ્રહાયેલ છે, અને અમે હાલમાં જે કંઈપણ સેવા આપીએ છીએ તે તેમના પર તાલીમ આપવામાં આવ્યું છે.
  • અલગ, સંપાદનો અને ઓડિયો વૉઇસ લેબમાં પ્રદાન કરો ટોગલ (/privacy-settings/ પર પણ, મૂળભૂત બંધ પણ) તમે CC-BY-SA-4.0 ની અંદર અમારા વૉઇસ લેબ ડેટાસેટમાં સુધારેલ લખાણ સાથે જોડાયેલ, તમે સુધારેલા સેગમેન્ટોના ઓડિયો પ્રદાન કરવા માટે પસંદ કરો. બે ટોગલ સ્વતંત્ર છે - તમે કોઈપણ, બંને, અથવા કોઈપણને પણ પરવાનગી આપી શકો છો.
  • ઓડિયો તમે અપલોડ કરો તે cleanup_uploads cron વડે ૨૪ કલાકની અંદર કાઢી નાંખવામાં આવે છે - UNLESS તમે \ ને પસંદ કરો

ચોકસાઈ અને ભૂલો

AI અનુવાદ સંપૂર્ણ નથી. શબ્દ ભૂલ દરો બોલનાર ઉચ્ચાર, ઓડિયો ગુણવત્તા, ભાષા, અને ડોમેઇન શબ્દકોશ દ્વારા બદલાય છે. મહત્વપૂર્ણ વપરાશ માટે (કાયદાકીય, તબીબી, નિયંત્રિત ઉદ્યોગો) મૂળ ઓડિયો સામે ચકાસો. અમારા જાહેર WER બેન્ચમાર્ક મોડેલ પ્રતિ છે /models/.

અનુરૂપતા પ્રશ્નો

યુરોપિયન યુનિયન એઆઈ એક્ટ, જીડીપીઆર અથવા અન્ય અનુરૂપતા પ્રશ્નો માટે: hello@stt.ai અથવા વાપરો સંપર્ક ફોર્મ.

છેલ્લે સુધારેલ: 2026-08-05.