AI پاليسي ۽ شفافيت
ڇا اسين ائ اي استعمال ڪندا آهيون، جتي اهو هلندو آهي، ۽ اسان ڪيئن ظاھر ڪرڻ جي ضرورتن کي پورو ڪندا آهيون (EU AI Act Article 50، اثرائتو 2026-08-02).
TL;DR
- سڀ ترنسڪريٽ AI-جڙيل آهن. هر نڪتو هڪ مشين-پڙھڻ جي قابل اڀياس کڻي.
- سڀ AI اسان جي پنهنجي GPU تي هلندو آهي. اسان توهان جي آڊيو يا متن کي OpenAI، Anthroponic، گوگل، يا ڪنهن به ٽيون پارٽي LLM API ڏانهن نه موڪليندا آهيون.
- اسان توھان جي ترڪيبن تي بنياد ماڊل نه سيکاريندا آھيون. رڳو هڪ opt-in fine-tune استعمال ڪري ٿو درستيون توھان واضح طور تي ڪندا آھيو.
- سيٽل آواز جي کلون (TTS) واضح طور تي AI-جنائزڊ طور تي فائلن جي نالي، ميٽا ڊيٽا ۽ صفحي تي نشان لڳل آهن.
ماڊل استعمال ڪيون ٿا
| ماڊل | لاءِ استعمال ٿيل | لائسنس | تي ھلندو آھي |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | ترڪيب | MIT | اسان جو GPU |
| STT.ai Enhanced (custom fine-tune) | ترڪيب (پيوشا) | MIT (base) / Proprietary (fine-tune weights) | اسان جو GPU |
| Vosk | لفظن جو ريئل ٽائيم اسٽريمنگ | Apache 2.0 | اسان جو GPU |
| SpeechBrain ECAPA-TDNN | اسپيڪر | Apache 2.0 | اسان جو GPU |
| MadLAD-400 3B | ترجمو (450+ ٻوليون) | Apache 2.0 | اسان جو GPU |
| Qwen2.5-1.5B (llama.cpp) | خلاصو، تجزيو، مواد پيدا ڪرڻ، RAG چيٽ | Apache 2.0 | اسان جو GPU |
| F5-TTS | آواز جو کلون / متن کان ڳالھائڻ | MIT | اسان جو GPU |
| all-MiniLM-L6-v2 | RAG ڳولا لاءِ داخلا | Apache 2.0 | اسان جو GPU |
اسان ڪنهن به خاصيت لاءِ OpenAI، Anthropic، Google Cloud، يا ڪنهن به ٽئين پارٽي جي LLM API کي سڏ نه ڪندا آهيون. مٿين هر ماڊل اسان جي هارڊويئر تي هلندو آهي ۽ اسان جي مالڪ ۽ آپريٽنگ. رڳو ٻاهرين AI سروس جيڪا اسان استعمال ڪندا آهيون translateapi.ai (۽ Muddy Holdings) UI سٽن جي ترجمي لاءِ - اهو ڪڏهن به توهان جي نقل ڪيل مواد کي نه ڇهي.
اسان AI نسل کي ڪيئن ظاهر ڪريون ٿا
- HTML صفحا: شامل ڪريو <meta name=\
- متن برآمد (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): هر فائل جي مٿان 'AI-generated transcript' هيڊر لائين شامل ڪريو.
- سنٿٽڪ آواز / TTS نڪتو: WAV فائلون ميٽا ڊيٽا ۾'synthetic-voice' ٽيگ ۽ ڊائون لوڊ صفحي تي واضح نوٽيس شامل ڪن ٿيون. ٻڌڻ لائق عدم قبوليت روڊ ميٽ تي آهي.
- API جواب: هر JSON جواب ۾ _ai_generated: true ميدان شامل ڪريو جنھن ۾ ترڪيب ٿيل مواد آھي.
تربيتي ڊيٽا
- بيس ماڊل (Whisper, MadLAD, Qwen, etc) اڳ ۾ تربيت ڏنل آهن، انھن کي انھن جي متعلقه شايع ڪندڙن کان اڳ ۾ تربيت ڏني وئي آھي. اسين انھن کي انھن جي شحن جي طور تي استعمال ڪندا آھيون.
- توھان جو ترانسڪريٽ بيس ماڊل کي تربيت ڏيڻ لاءِ استعمال نه ڪيو ويندو آھي.
- جيڪڏھن توھان ھڪ ترانسڪرپٽ حصي کي درست ڪريو (پلانڪ آئڪن) يا ان کي غلط طور نشان ڪريو (فلاگ آئڪن)، ۽ توھان /privacy-settings/ (\
- جدا جدا، آواز جي ليبارٽري ۾ ترميمون ۽ آڊيو شامل ڪرڻ جو اختيار (/privacy-settings/ تي به، پڻ ڊفالٽ طور بند) توهان کي اسان جي آواز جي ليبارٽري ڊيٽا سيٽ ۾ توهان جي ترميم ڪيل حصن جي آڊيو شامل ڪرڻ جي اجازت ڏئي ٿو، صحيح ڪيل متن سان گڏ، CC-BY-SA-4.0 تحت. ٻه اختيار مستقل آهن - توهان ٻنهي کي يا ڪنهن کي به قبول ڪري سگهو ٿا.
- اوھان جو آڊيو اپ لوڊ ڪرڻ 24 ڪلاڪن اندر cleanup_uploads cron ذريعي ختم ڪيو ويندو آھي - جيستائين اوھان ان کي چونڊيو نه آھي\
درستگي ۽ غلطيون
AI ترجمو مڪمل نه آهي. لفظ غلطي جي شرح ڳالهائيندڙ جي ڌيان، آڊيو معيار، ٻولي ۽ ڊومين وڪيپيڊيا تي منحصر آهي. بحراني استعمال (قانوني، طبي، رياستي صنعتن) لاءِ اصل آڊيو جي مقابلي ۾ تصديق ڪريو. اسان جي عوامي WER بينچ مارڪس هر ماڊل تي آهن /models/.
مطابقت جا سوال
يو ايڪٽ، GDPR يا ٻين مطابقت جي سوالن لاءِ: hello@stt.ai يا استعمال ڪريو رابطي جي فارم.
آخري اپڊيٽ: 2026-04-26.