AI စည်းမျဉ်းစည်းကမ်းများနှင့်ပွင့်လင်းမြင်သာမှု
ကျွန်တော်တို့ကိုအသုံးပြုတဲ့ AI ကိုဘာလဲ၊ ဘယ်မှာ run တယ်၊ ကျွန်တော်တို့ဟာထုတ်ဖော်ပြောဆိုမှုလိုအပ်ချက်တွေကိုလိုက်နာပုံ (EU AI Act Article 50, effective 2026-08-02)။
TL;DR
- အားလုံး transcripts AI-generated နေကြသည်. အားလုံး output ကိုစက်-ဖတ်ရှုနိုင်သောထုတ်ဖော်ပြောဆိုမှုဆောင်ကြဉ်း.
- အားလုံး AI ကျွန်တော်တို့ရဲ့ကိုယ်ပိုင် GPU ကိုပေါ်တွင် runs. ကျနော်တို့ OpenAI ကိုသင့်ရဲ့အသံသို့မဟုတ်စာသားမပို့ပါ, Anthropic, Google, သို့မဟုတ်မည်သည့်တတိယပါတီ LLM API ကို.
- ကျနော်တို့သင်၏ transcripts အပေါ်အခြေခံမော်ဒယ်များမသင်ကြား. တစ်ခုတည်းသော opt-in fine-tune ကိုသင်ရှင်းလင်းစွာလုပ်ဖို့ပြင်ဆင်မှုများကိုအသုံးပြု.
- ပေါင်းစပ်အသံဖန်တီးမှု (TTS) များကို ဖိုင်နာမည်၊ metadata နှင့် စာမျက်နှာတွင် AI-generated ဟု ရှင်းလင်းစွာ ဖော်ပြထားသည်။
ကျွန်တော်တို့အသုံးပြုတဲ့မော်ဒယ်များ
| မော်ဒယ် | အသုံးပြုသည် | လိုင်စင် | အပေါ်တွင် လုပ်ဆောင်နေသည် |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | စာလုံးပေါင်း (စံ) | MIT | ကျွန်တော်တို့ရဲ့ GPU |
| STT.ai Enhanced (custom fine-tune) | transcription (ပေးဆောင်အစီအစဉ်များ) | MIT (base) / Proprietary (fine-tune weights) | ကျွန်တော်တို့ရဲ့ GPU |
| Vosk | တကယ့်အချိန်စကားလုံးစီးဆင်းမှု | Apache 2.0 | ကျွန်တော်တို့ရဲ့ GPU |
| SpeechBrain ECAPA-TDNN | ဟောပြောသူ စာရင်းသွင်းခြင်း | Apache 2.0 | ကျွန်တော်တို့ရဲ့ GPU |
| MadLAD-400 3B | ဘာသာပြန်ဆို (450+ ဘာသာစကားများ) | Apache 2.0 | ကျွန်တော်တို့ရဲ့ GPU |
| Qwen2.5-1.5B (llama.cpp) | အကျဉ်းချုပ်, ဆန်းစစ်ခြင်း, အကြောင်းအရာမျိုးဆက်, RAG စကားပြော | Apache 2.0 | ကျွန်တော်တို့ရဲ့ GPU |
| F5-TTS | အသံ clone / စာသား-to-စကားပြော | MIT | ကျွန်တော်တို့ရဲ့ GPU |
| all-MiniLM-L6-v2 | RAG ရှာဖွေရေးအတွက် Embeddings | Apache 2.0 | ကျွန်တော်တို့ရဲ့ GPU |
ကျနော်တို့ OpenAI ကိုခေါ်ဆိုခြင်းမရှိပါ, Anthropic, Google Cloud, သို့မဟုတ်မည်သည့် feature ကိုများအတွက်မည်သည့်တတိယပါတီ LLM API ကို. အပေါ်ကတိုင်းမော်ဒယ်ကျွန်တော်တို့ပိုင်ဆိုင်နှင့်လည်ပတ် hardware ပေါ်မှာ runs. ကျွန်တော်တို့ကိုအသုံးပြုသောတစ်ခုတည်းသောပြင်ပ AI ကိုဝန်ဆောင်မှု translateapi.ai ဖြစ်ပါတယ်။ (ဒါဟာလည်း Muddy Holdings) UI strings ကိုဘာသာပြန်ဆိုရန် - ဒီသင်၏ transcribed အကြောင်းအရာကိုမထိပါ.
ကျွန်တော်တို့ရဲ့ AI မျိုးဆက်ကိုထုတ်ဖော်ဘယ်လို
- HTML စာမျက်နှာများ transcript: <meta name =\ ပါဝင်သည်
- စာသားတင်ပို့ (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): အားလုံးဖိုင်များ၏ထိပ်တွင် 'AI-generated transcript' header line ကိုပါဝင်သည်။
- ပေါင်းစပ်အသံ / TTS output ကို: WAV ဖိုင်များကို metadata တွင်'synthetic-voice' tag နှင့် download စာမျက်နှာပေါ်တွင်ရှင်းလင်းသောအသိပေးချက်ပါဝင်သည်။
- API တုံ့ပြန်ချက်: အ _ai_generated ပါဝင်သည်: transcribed အကြောင်းအရာပါဝင်သည်သောတိုင်း JSON တုံ့ပြန်မှုအတွက်မှန်ကန်သော Field ကို။
သင်တန်းအချက်အလက်များ
- အခြေခံအဆောက်အအုံပုံစံများ (Whisper, MadLAD, Qwen, စသည်တို့ကို) သူတို့ရဲ့သီးခြားထုတ်ဝေသူမှ pre-လေ့ကျင့်လာ. ကျနော်တို့က-ပို့ဆောင်အဖြစ်သူတို့ကိုအသုံးပြု.
- သင်၏ transcripts အခြေခံ model များကိုလေ့ကျင့်ရန်မသုံးကြဘူး.
- သင် transcript segment ကိုပြင်ဆင်လျှင် (the pencil icon) သို့မဟုတ်မမှန်ကန်သောအမှတ် (the flag icon), AND YOU have opted in at /privacy-settings/ (\
- သီးခြား, the Contribute corrections plus audio to Voice Lab toggle (also at /privacy-settings/, also default off) opts you in to contributing the audio of segments you correct, paired with the corrected text, to our Voice Lab dataset under CC-BY-SA-4.0.
- သင် upload လုပ်ထားတဲ့အသံကိုအတွင်းမှာဖျက်ပစ်သည် 24 နာရီ cleanup_uploads cron မှတဆင့် — သင်သို့ရွေးထားခြင်းမရှိဘဲ\
တိကျမှုနှင့်အမှားများ
AI ဘာသာပြန်ချက်ပြီးပြည့်စုံသည်မဟုတ်. စကားလုံးအမှားနှုန်းပြောကြားသူအသံထွက်, audio အရည်အသွေး, ဘာသာစကား, နှင့်ဒေသဆိုင်ရာဝေါဟာရများအားဖြင့်ကွဲပြားခြားနား. အရေးပါသောအသုံးပြုမှုအတွက် (ဥပဒေရေးရာ, ဆေးဘက်ဆိုင်ရာ, စည်းမျဉ်းထုတ်လုပ်မှု) မူရင်းအသံကိုဆန့်ကျင်စစ်ဆေး. ကျွန်တော်တို့ရဲ့ပြည်သူ့ WER စံချိန်စံညွှန်းများမှာ model ကိုတစ်ဦးလျှင် /models/.
လိုက်နာမှုမေးခွန်းများ
EU AI Act အတွက်, GDPR, သို့မဟုတ်အခြားလိုက်နာမှုမေးခွန်းများ: hello@stt.ai သို့မဟုတ်အသုံးပြုပါ ဆက်သွယ်ရေးပုံစံ.
နောက်ဆုံး ပြုပြင်ခဲ့သည်: 2026-04-26.