AI नीति र पारदर्शिता

हामी के एआई प्रयोग गर्दछौं, यो कहाँ चल्छ, र हामी कसरी खुलासा आवश्यकताहरू पालना गर्दछौं (यूरो एआई एक्ट लेख 50, प्रभावकारी 2026-08-02)।

TL;DR

  • सबै transcripts AI-जनरेट छन्। हरेक निर्गत एक मेसिन-पढ्न योग्य खुलासा बोक्छ।
  • सबै AI हाम्रो आफ्नै GPU मा चल्छ। हामी OpenAI, Anthropic, Google, वा कुनै पनि तेस्रो-पक्ष LLM API मा तपाईंको अडियो वा पाठ पठाउँदैनौं।
  • हामी आफ्नो transcripts मा आधार मोडेल ट्रेन छैन. केवल एक विकल्प-मा राम्रो-ट्यून तपाईं स्पष्ट बनाउन सुधार प्रयोग.
  • यसको प्रकाशन काठमाडौंमा वार्षिक अवधिमा हुन्छ, जुन पत्रिकाको प्रकाशन र प्रकाशन कार्यमा निर्भर रहन्छ।

हामी प्रयोग गर्ने नमूनाहरू

नमूनायसका लागि प्रयोग गरिएकोइजाजतपत्रचलिरहेको छ
Whisper large-v3-turbo (faster-whisper)प्रतिलिपि (पूर्वनिर्धारित)MITहाम्रो GPU
STT.ai Enhanced (custom fine-tune)अनुवाद (पढाइ योजना)MIT (base) / Proprietary (fine-tune weights)हाम्रो GPU
Voskवास्तविक समय शब्द स्ट्रिमिङApache 2.0हाम्रो GPU
SpeechBrain ECAPA-TDNNवक्ता डायराइजेसनApache 2.0हाम्रो GPU
MadLAD-400 3Bअनुवाद (450+ भाषाहरू)Apache 2.0हाम्रो GPU
Qwen2.5-1.5B (llama.cpp)सारांश, विश्लेषण, सामग्री उत्पादन, RAG च्याटApache 2.0हाम्रो GPU
F5-TTSआवाज क्लोनिङ / पाठ-देखि-वाचनMITहाम्रो GPU
all-MiniLM-L6-v2RAG खोजीका लागि सम्मिलनApache 2.0हाम्रो GPU

हामी कुनै पनि सुविधाको लागि OpenAI, Anthropic, Google Cloud, वा कुनै पनि तेस्रो-पक्ष LLM API कल गर्दैनौं। माथिको हरेक मोडेल हार्डवेयरमा चल्छ जुन हामी स्वामित्व र सञ्चालन गर्दछौं। हामी प्रयोग गर्ने एक मात्र बाह्य AI सेवा translateapi.ai (त्यो पनि Muddy Holdings) UI स्ट्रिङहरू अनुवाद गर्नको लागि हो - यो कहिल्यै तपाईंको transcribed सामग्री छुँदैन।

हामी कसरी एआई पुस्ता खुलासा

  • HTML पृष्ठहरूको प्रतिलिपि बनाउनुहोस्: <meta name=\ समावेश गर्नुहोस्
  • पाठ निर्यात (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): प्रत्येक फाइलको माथिमा 'AI-जनरेट गरिएको transcript' हेडर लाइन समावेश गर्नुहोस् ।
  • सिंथेटिक आवाज / TTS निर्गत: WAV फाइलहरू मेटाडेटामा 'सिन्टिसेटिक-भाइस्' ट्याग समावेश गर्दछ र डाउनलोड पृष्ठमा स्पष्ट सूचना। सुनौलो खण्डन मार्गचित्रमा छ।
  • API प्रतिक्रिया: एउटा _ai_generated समावेश गर्नुहोस्: प्रत्येक JSON प्रतिक्रियामा सही फिल्ड छ जुन प्रतिलिपि गरिएको सामग्री समावेश गर्दछ।

प्रशिक्षण डेटा

  • आधार मोडेल (घुम्टो, MadLAD, Qwen, आदि) आफ्नो सम्बन्धित प्रकाशक देखि पूर्व-प्रशिक्षक आउन. हामी तिनीहरूलाई प्रयोग रूपमा-शिप.
  • तपाईँको transcripts आधार नमूना ट्रेन गर्न प्रयोग गरिदैन।
  • यदि तपाईँले एउटा खण्ड (कलम प्रतिमा) सुधार गर्नुभयो वा यसलाई गलत (झण्डा प्रतिमा) मा चिन्ह लगाउनु भयो भने, र तपाईँले /privacy-settings/ (\
  • अलग अलग, आवाज प्रयोगशालामा सुधारहरू थप अडियो योगदान गर्न टगल (/privacy-settings/ मा पनि, पूर्वनिर्धारित बन्द पनि) तपाईंलाई तपाईंले सुधार गरेको खण्डहरूको अडियो योगदान गर्न चयन गर्दछ, सुधार गरिएको पाठसँग जोडिएको, CC-BY-SA-4.0 अन्तर्गत हाम्रो आवाज प्रयोगशाला डाटासेटमा। दुई टगलहरू स्वतन्त्र छन् - तपाईंले या त, दुवै, वा दुवै दिन सक्नुहुन्छ।
  • अडियो तपाईं अपलोड भित्र मेटिएको छ 24 घण्टा cleanup_uploads cron मार्फत — तपाईं मा चयन गरेको छैन नत्र \

सटीकता र त्रुटि

एआई प्रतिलिपि पूर्ण छैन। शब्द त्रुटि दर वक्ता उच्चारण, अडियो गुणस्तर, भाषा, र डोमेन शब्दावली द्वारा भिन्न। महत्वपूर्ण प्रयोग (कानूनी, चिकित्सा, नियमन उद्योग) लागि मूल अडियो विरुद्ध पुष्टि। प्रति मोडेल हाम्रो सार्वजनिक WER बेन्चमार्क मा छन् /models/.

अनुरूपता प्रश्न

युरोपेली युनियन एआई एक्ट, GDPR, वा अन्य अनुपालन प्रश्नहरूको लागि: hello@stt.ai वा प्रयोग गर्नुहोस् सम्पर्क फारम.

अन्तिम अद्यावधिक: 2026-04-26.