AI ප්රතිපත්තිය සහ විනිවිදභාවය
අපි භාවිතා කරන AI කුමක්ද, එය ධාවනය වන ස්ථානය සහ අපි හෙළිදරව් කිරීමේ අවශ්යතා සපුරාලන ආකාරය (යුරෝපා සංගමයේ AI පනත ලිපිය 50, බලාත්මක 2026-08-02).
ඩී.ආර්.
- හැම පිටපතක්ම AI-උත්පාදනය කරල තියනව. හැම ප්රථිපලයක්ම යන්ත්ර කියවිය හැකි හෙළිදරව්වක් ගෙනියනවා.
- සියලු AI අපගේ ම GPU මත ධාවනය වේ. අපි OpenAI, Anthropic, Google, හෝ ඕනෑම තෙවන පාර්ශවීය LLM API වෙත ඔබේ ශබ්ද හෝ පෙළ යවන්නේ නැත.
- අපි ඔබේ පරිවර්තනය මත ඕනෑම ආකෘතිය පුහුණු නැහැ. අපි ධාවනය සෑම ආකෘතියක්ම පිටතට-the-shelf විවෘත මූලාශ්රය ආකෘතිය වේ. ඔබ පැහැදිලිව සිදු නිවැරදි කිරීම් ඔබ තෝරා නම් පමණක් එකතු කරනු ලැබේ.
- සංස්ලේෂිත හඬ ක්ලෝන (TTS) ගොනු නාමය, මෙටා දත්ත සහ පිටුවෙහි AI-ජනනය කරන ලද ලෙස පැහැදිලිව ලේබල් කර ඇත.
අපි භාවිතා කරන ආකෘති
| ආකෘතිය | සඳහා භාවිතා කරයි | බලපත්රය | ක්රියාත්මක වේ |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | පරිවර්තනය (පෙරනිමි) | MIT | අපගේ GPU |
| Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced” | පරිවර්තනය (ගෙවීම් සැලසුම්) | MIT | අපගේ GPU |
| Vosk | සැබෑ-කාලය වචන ධාරාව | Apache 2.0 | අපගේ GPU |
| SpeechBrain ECAPA-TDNN | කථානායක diarization | Apache 2.0 | අපගේ GPU |
| MadLAD-400 3B | පරිවර්තනය (450+ භාෂා) | Apache 2.0 | අපගේ GPU |
| Qwen2.5-1.5B (llama.cpp) | සාරාංශය, විශ්ලේෂණය, අන්තර්ගතය ජනනය, RAG කතාබස් | Apache 2.0 | අපගේ GPU |
| F5-TTS | හඬ ක්ලෝන / පෙළ-කථාව | MIT | අපගේ GPU |
| all-MiniLM-L6-v2 | RAG සෙවුම් සඳහා embeddings | Apache 2.0 | අපගේ GPU |
“STT.ai Enhanced” අපගේ GPU මත ධාවනය වන Whisper විශාල-v3 සඳහා අපගේ නිෂ්පාදන නාමය වේ. එය අභිරුචි ආකෘතිය නොවේ, හොඳින් සකස්, හෝ ව්යාජ බර - එය විශාලතම හා වඩාත් නිවැරදි Whisper Checkpoint වේ. එය පෙරනිමි Whisper විශාල-v3-ටර්බෝ වඩා නිවැරදි වේ, හා 1.5x ගැන diarized රැකියාවක් මත මන්දගාමී, අපගේ දෘඩාංග මත මැන.
අපි OpenAI, Anthropic, Google Cloud, හෝ ඕනෑම විශේෂාංගයක් සඳහා ඕනෑම තෙවන පාර්ශවීය LLM API කතා කරන්නේ නැහැ. ඉහත සෑම ආකෘතියක්ම අපි අයිති හා ක්රියාත්මක දෘඩාංග මත ධාවනය වේ. අපි භාවිතා කරන එකම බාහිර AI සේවාව UI strings පරිවර්තනය සඳහා translateapi.ai (ද Muddy Holdings) වේ - මෙම ඔබේ පරිවර්තනය අන්තර්ගතය ස්පර්ශ කරන්නේ නැහැ.
අපි AI පරම්පරාව හෙළි කරන ආකාරය
- HTML පිටු පරිවර්තනය කරන්න: ඇතුළත් <meta නම =\
- පෙළ අපනයන (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): සෑම ගොනුවක් ඉහළ කොටසේ 'AI-උත්පාදනය පරිවර්තනය' හිස් පේළියක් ඇතුළත්.
- සංයුක්ත හඬ / TTS ප්රතිදානය: WAV ගොනු මෙටා දත්ත හා බාගත පිටුව මත පැහැදිලි දැනුම් දී 'සංයෝජනය-හඬ' ටැග් ඇතුළත් වේ. ශ්රව්ය වගකීම් විරහිත මාර්ග සිතියම මත වේ.
- API ප්රතිචාර: ඇත්ත ක්ෂේත්රය: පරිවර්තනය අන්තර්ගතය අඩංගු වන සෑම JSON ප්රතිචාරයක් තුළ _ai_generated ඇතුළත්.
පුහුණු දත්ත
- මූලික ආකෘති (විස්පර්, MadLAD, Qwen, ආදිය) ඔවුන්ගේ අදාළ ප්රකාශකයන්ගෙන් පෙර පුහුණු පැමිණේ. අපි නැව්ගත කිරීම ලෙස ඔවුන් භාවිතා.
- ඔයාගේ පිටපත් පාවිච්චි වෙන්නේ නෑ මූලික ආකෘති පුහුණු කරන්න.
- ඔබ පරිවර්තනය කොටසක් නිවැරදි (පැන්සල් අයිකනය) හෝ එය වැරදි සලකුණු (කොඩි අයිකනය), හා ඔබ /privacy-settings/ දී තෝරා ගෙන තිබේ නම් ("ආකෘතිය පුහුණු" toggle, පෙරනිමියෙන් අක්රිය), (වැරදි පෙළ → නිවැරදි පෙළ) යුගල අනාගත පෙළ-සංශෝධනය ආකෘතිය පුහුණු කිරීමට එකතු කළ හැක. පමණක් පෙළ යුගලය — කිසි විටෙකත් අවට ශබ්ද — මෙම මාර්ගය විසින් භාවිතා කරනු ලැබේ. එවැනි ආකෘතිය අද නොපවතී: යුගල ගබඩා පමණක්, අපි දැනට සේවය කිසිවක් ඔවුන් මත පුහුණු කර ඇත.
- වෙන් වෙන්වම, ශ්රව්ය රසායනාගාරය සඳහා නිවැරදි කිරීම් සහ ශ්රව්ය දායකත්වයට දායක වන්න (/privacy-settings/ හි ද, ද පෙරනිමියෙන් අක්රිය) ඔබ නිවැරදි කොටස් ශ්රව්ය දායකත්වයට ඔබ තෝරා, නිවැරදි පෙළ සමග යුගල, CC-BY-SA-4.0 යටතේ අපගේ ශ්රව්ය රසායනාගාරය දත්ත කට්ටලයට. මෙම දෙකම ස්වාධීන වේ - ඔබ එකක් හෝ ලබා දිය හැකිය, දෙකම, හෝ දෙකම.
- ඔබ අප් ලෝඩ් ශ්රව්ය තුළ මකා දමයි 24 cleanup_uploads cron හරහා පැය — ඔබ තෝරා නොමැති නම් \
නිරවද්යතාවය සහ දෝෂ
AI පරිවර්තනය පරිපූර්ණ නොවේ. වචනය දෝෂ අනුපාත කථානායක උච්චාරණය, ශ්රව්ය ගුණාත්මක, භාෂාව, සහ ඩොමේන් වචන සංඛ්යාව අනුව වෙනස් වේ. වැදගත් භාවිතය සඳහා (නීතිමය, වෛද්ය, රෙගුලාසි කර්මාන්ත) මුල් ශ්රව්ය එරෙහිව තහවුරු. අපේ මහජන WER ආකෘතියකට අනුව සංගුණක දී /models/.
අනුකූලතා ප්රශ්න
යුරෝපා සංගමයේ AI පනත සඳහා, GDPR, හෝ වෙනත් අනුකූල ප්රශ්න: hello@stt.ai හෝ භාවිතා කරන්න සම්බන්ධතා ආකෘතිය.
අවසන් යාවත්කාලීන කිරීම: 2026-08-05.