AI ප්රතිපත්තිය සහ විනිවිදභාවය
අපි භාවිතා කරන AI කුමක්ද, එය ධාවනය වන ස්ථානය සහ අපි හෙළිදරව් කිරීමේ අවශ්යතා සපුරාලන ආකාරය (යුරෝපා සංගමයේ AI පනත ලිපිය 50, බලාත්මක 2026-08-02).
ඩී.ආර්.
- හැම පිටපතක්ම AI-උත්පාදනය කරල තියනව. හැම ප්රථිපලයක්ම යන්ත්ර කියවිය හැකි හෙළිදරව්වක් ගෙනියනවා.
- සියලු AI අපගේ ම GPU මත ධාවනය වේ. අපි OpenAI, Anthropic, Google, හෝ ඕනෑම තෙවන පාර්ශවීය LLM API වෙත ඔබේ ශබ්ද හෝ පෙළ යවන්නේ නැත.
- අපි ඔබේ පරිවර්තන මත පදනම් ආකෘති පුහුණු නැහැ. පමණක් තෝරා-in fine-tune ඔබ පැහැදිලිව සිදු නිවැරදි කිරීම් භාවිතා.
- සංස්ලේෂිත හඬ ක්ලෝන (TTS) ගොනු නාමය, මෙටා දත්ත සහ පිටුවෙහි AI-ජනනය කරන ලද ලෙස පැහැදිලිව ලේබල් කර ඇත.
අපි භාවිතා කරන ආකෘති
| ආකෘතිය | සඳහා භාවිතා කරයි | බලපත්රය | ක්රියාත්මක වේ |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | පරිවර්තනය (පෙරනිමි) | MIT | අපගේ GPU |
| STT.ai Enhanced (custom fine-tune) | පරිවර්තනය (ගෙවීම් සැලසුම්) | MIT (base) / Proprietary (fine-tune weights) | අපගේ GPU |
| Vosk | සැබෑ-කාලය වචන ධාරාව | Apache 2.0 | අපගේ GPU |
| SpeechBrain ECAPA-TDNN | කථානායක diarization | Apache 2.0 | අපගේ GPU |
| MadLAD-400 3B | පරිවර්තනය (450+ භාෂා) | Apache 2.0 | අපගේ GPU |
| Qwen2.5-1.5B (llama.cpp) | සාරාංශය, විශ්ලේෂණය, අන්තර්ගතය ජනනය, RAG කතාබස් | Apache 2.0 | අපගේ GPU |
| F5-TTS | හඬ ක්ලෝන / පෙළ-කථාව | MIT | අපගේ GPU |
| all-MiniLM-L6-v2 | RAG සෙවුම් සඳහා embeddings | Apache 2.0 | අපගේ GPU |
අපි OpenAI, Anthropic, Google Cloud, හෝ ඕනෑම විශේෂාංගයක් සඳහා ඕනෑම තෙවන පාර්ශවීය LLM API කතා කරන්නේ නැහැ. ඉහත සෑම ආකෘතියක්ම අපි අයිති හා ක්රියාත්මක දෘඩාංග මත ධාවනය වේ. අපි භාවිතා කරන එකම බාහිර AI සේවාව UI strings පරිවර්තනය සඳහා translateapi.ai (ද Muddy Holdings) වේ - මෙම ඔබේ පරිවර්තනය අන්තර්ගතය ස්පර්ශ කරන්නේ නැහැ.
අපි AI පරම්පරාව හෙළි කරන ආකාරය
- HTML පිටු පරිවර්තනය කරන්න: ඇතුළත් <meta නම =\
- පෙළ අපනයන (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): සෑම ගොනුවක් ඉහළ කොටසේ 'AI-උත්පාදනය පරිවර්තනය' හිස් පේළියක් ඇතුළත්.
- සංයුක්ත හඬ / TTS ප්රතිදානය: WAV ගොනු මෙටා දත්ත හා බාගත පිටුව මත පැහැදිලි දැනුම් දී 'සංයෝජනය-හඬ' ටැග් ඇතුළත් වේ. ශ්රව්ය වගකීම් විරහිත මාර්ග සිතියම මත වේ.
- API ප්රතිචාර: ඇත්ත ක්ෂේත්රය: පරිවර්තනය අන්තර්ගතය අඩංගු වන සෑම JSON ප්රතිචාරයක් තුළ _ai_generated ඇතුළත්.
පුහුණු දත්ත
- මූලික ආකෘති (විස්පර්, MadLAD, Qwen, ආදිය) ඔවුන්ගේ අදාළ ප්රකාශකයන්ගෙන් පෙර පුහුණු පැමිණේ. අපි නැව්ගත කිරීම ලෙස ඔවුන් භාවිතා.
- ඔයාගේ පිටපත් පාවිච්චි වෙන්නේ නෑ මූලික ආකෘති පුහුණු කරන්න.
- ඔබ පරිවර්තනය කොටසක් නිවැරදි නම් (පැන්සල් අයිකනය) හෝ එය වැරදි සලකුණු (ධජය අයිකනය), ඔබ / පෞද්ගලිකත්ව-සංරචක / දී තෝරා ඇත (\
- වෙන් වෙන්වම, ශ්රව්ය රසායනාගාරය සඳහා නිවැරදි කිරීම් සහ ශ්රව්ය දායකත්වයට දායක වන්න (/privacy-settings/ හි ද, ද පෙරනිමියෙන් අක්රිය) ඔබ නිවැරදි කොටස් ශ්රව්ය දායකත්වයට ඔබ තෝරා, නිවැරදි පෙළ සමග යුගල, CC-BY-SA-4.0 යටතේ අපගේ ශ්රව්ය රසායනාගාරය දත්ත කට්ටලයට. මෙම දෙකම ස්වාධීන වේ - ඔබ එකක් හෝ ලබා දිය හැකිය, දෙකම, හෝ දෙකම.
- ඔබ අප් ලෝඩ් ශ්රව්ය තුළ මකා දමයි 24 cleanup_uploads cron හරහා පැය — ඔබ තෝරා නොමැති නම් \
නිරවද්යතාවය සහ දෝෂ
AI පරිවර්තනය පරිපූර්ණ නොවේ. වචනය දෝෂ අනුපාත කථානායක උච්චාරණය, ශ්රව්ය ගුණාත්මක, භාෂාව, සහ ඩොමේන් වචන සංඛ්යාව අනුව වෙනස් වේ. වැදගත් භාවිතය සඳහා (නීතිමය, වෛද්ය, රෙගුලාසි කර්මාන්ත) මුල් ශ්රව්ය එරෙහිව තහවුරු. අපේ මහජන WER ආකෘතියකට අනුව සංගුණක දී /models/.
අනුකූලතා ප්රශ්න
යුරෝපා සංගමයේ AI පනත සඳහා, GDPR, හෝ වෙනත් අනුකූල ප්රශ්න: hello@stt.ai හෝ භාවිතා කරන්න සම්බන්ධතා ආකෘතිය.
අවසන් යාවත්කාලීන කිරීම: 2026-04-26.