AI नीति र पारदर्शिता
हामी के एआई प्रयोग गर्दछौं, यो कहाँ चल्छ, र हामी कसरी खुलासा आवश्यकताहरू पालना गर्दछौं (यूरो एआई एक्ट लेख 50, प्रभावकारी 2026-08-02)।
TL;DR
- सबै transcripts AI-जनरेट छन्। हरेक निर्गत एक मेसिन-पढ्न योग्य खुलासा बोक्छ।
- सबै AI हाम्रो आफ्नै GPU मा चल्छ। हामी OpenAI, Anthropic, Google, वा कुनै पनि तेस्रो-पक्ष LLM API मा तपाईंको अडियो वा पाठ पठाउँदैनौं।
- हामी आफ्नो transcripts मा आधार मोडेल ट्रेन छैन. केवल एक विकल्प-मा राम्रो-ट्यून तपाईं स्पष्ट बनाउन सुधार प्रयोग.
- यसको प्रकाशन काठमाडौंमा वार्षिक अवधिमा हुन्छ, जुन पत्रिकाको प्रकाशन र प्रकाशन कार्यमा निर्भर रहन्छ।
हामी प्रयोग गर्ने नमूनाहरू
| नमूना | यसका लागि प्रयोग गरिएको | इजाजतपत्र | चलिरहेको छ |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | प्रतिलिपि (पूर्वनिर्धारित) | MIT | हाम्रो GPU |
| STT.ai Enhanced (custom fine-tune) | अनुवाद (पढाइ योजना) | MIT (base) / Proprietary (fine-tune weights) | हाम्रो GPU |
| Vosk | वास्तविक समय शब्द स्ट्रिमिङ | Apache 2.0 | हाम्रो GPU |
| SpeechBrain ECAPA-TDNN | वक्ता डायराइजेसन | Apache 2.0 | हाम्रो GPU |
| MadLAD-400 3B | अनुवाद (450+ भाषाहरू) | Apache 2.0 | हाम्रो GPU |
| Qwen2.5-1.5B (llama.cpp) | सारांश, विश्लेषण, सामग्री उत्पादन, RAG च्याट | Apache 2.0 | हाम्रो GPU |
| F5-TTS | आवाज क्लोनिङ / पाठ-देखि-वाचन | MIT | हाम्रो GPU |
| all-MiniLM-L6-v2 | RAG खोजीका लागि सम्मिलन | Apache 2.0 | हाम्रो GPU |
हामी कुनै पनि सुविधाको लागि OpenAI, Anthropic, Google Cloud, वा कुनै पनि तेस्रो-पक्ष LLM API कल गर्दैनौं। माथिको हरेक मोडेल हार्डवेयरमा चल्छ जुन हामी स्वामित्व र सञ्चालन गर्दछौं। हामी प्रयोग गर्ने एक मात्र बाह्य AI सेवा translateapi.ai (त्यो पनि Muddy Holdings) UI स्ट्रिङहरू अनुवाद गर्नको लागि हो - यो कहिल्यै तपाईंको transcribed सामग्री छुँदैन।
हामी कसरी एआई पुस्ता खुलासा
- HTML पृष्ठहरूको प्रतिलिपि बनाउनुहोस्: <meta name=\ समावेश गर्नुहोस्
- पाठ निर्यात (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): प्रत्येक फाइलको माथिमा 'AI-जनरेट गरिएको transcript' हेडर लाइन समावेश गर्नुहोस् ।
- सिंथेटिक आवाज / TTS निर्गत: WAV फाइलहरू मेटाडेटामा 'सिन्टिसेटिक-भाइस्' ट्याग समावेश गर्दछ र डाउनलोड पृष्ठमा स्पष्ट सूचना। सुनौलो खण्डन मार्गचित्रमा छ।
- API प्रतिक्रिया: एउटा _ai_generated समावेश गर्नुहोस्: प्रत्येक JSON प्रतिक्रियामा सही फिल्ड छ जुन प्रतिलिपि गरिएको सामग्री समावेश गर्दछ।
प्रशिक्षण डेटा
- आधार मोडेल (घुम्टो, MadLAD, Qwen, आदि) आफ्नो सम्बन्धित प्रकाशक देखि पूर्व-प्रशिक्षक आउन. हामी तिनीहरूलाई प्रयोग रूपमा-शिप.
- तपाईँको transcripts आधार नमूना ट्रेन गर्न प्रयोग गरिदैन।
- यदि तपाईँले एउटा खण्ड (कलम प्रतिमा) सुधार गर्नुभयो वा यसलाई गलत (झण्डा प्रतिमा) मा चिन्ह लगाउनु भयो भने, र तपाईँले /privacy-settings/ (\
- अलग अलग, आवाज प्रयोगशालामा सुधारहरू थप अडियो योगदान गर्न टगल (/privacy-settings/ मा पनि, पूर्वनिर्धारित बन्द पनि) तपाईंलाई तपाईंले सुधार गरेको खण्डहरूको अडियो योगदान गर्न चयन गर्दछ, सुधार गरिएको पाठसँग जोडिएको, CC-BY-SA-4.0 अन्तर्गत हाम्रो आवाज प्रयोगशाला डाटासेटमा। दुई टगलहरू स्वतन्त्र छन् - तपाईंले या त, दुवै, वा दुवै दिन सक्नुहुन्छ।
- अडियो तपाईं अपलोड भित्र मेटिएको छ 24 घण्टा cleanup_uploads cron मार्फत — तपाईं मा चयन गरेको छैन नत्र \
सटीकता र त्रुटि
एआई प्रतिलिपि पूर्ण छैन। शब्द त्रुटि दर वक्ता उच्चारण, अडियो गुणस्तर, भाषा, र डोमेन शब्दावली द्वारा भिन्न। महत्वपूर्ण प्रयोग (कानूनी, चिकित्सा, नियमन उद्योग) लागि मूल अडियो विरुद्ध पुष्टि। प्रति मोडेल हाम्रो सार्वजनिक WER बेन्चमार्क मा छन् /models/.
अनुरूपता प्रश्न
युरोपेली युनियन एआई एक्ट, GDPR, वा अन्य अनुपालन प्रश्नहरूको लागि: hello@stt.ai वा प्रयोग गर्नुहोस् सम्पर्क फारम.
अन्तिम अद्यावधिक: 2026-04-26.