AI ප්රතිපත්තිය සහ විනිවිදභාවය

අපි භාවිතා කරන AI කුමක්ද, එය ධාවනය වන ස්ථානය සහ අපි හෙළිදරව් කිරීමේ අවශ්යතා සපුරාලන ආකාරය (යුරෝපා සංගමයේ AI පනත ලිපිය 50, බලාත්මක 2026-08-02).

ඩී.ආර්.

  • හැම පිටපතක්ම AI-උත්පාදනය කරල තියනව. හැම ප්‍රථිපලයක්ම යන්ත්ර කියවිය හැකි හෙළිදරව්වක් ගෙනියනවා.
  • සියලු AI අපගේ ම GPU මත ධාවනය වේ. අපි OpenAI, Anthropic, Google, හෝ ඕනෑම තෙවන පාර්ශවීය LLM API වෙත ඔබේ ශබ්ද හෝ පෙළ යවන්නේ නැත.
  • අපි ඔබේ පරිවර්තන මත පදනම් ආකෘති පුහුණු නැහැ. පමණක් තෝරා-in fine-tune ඔබ පැහැදිලිව සිදු නිවැරදි කිරීම් භාවිතා.
  • සංස්ලේෂිත හඬ ක්ලෝන (TTS) ගොනු නාමය, මෙටා දත්ත සහ පිටුවෙහි AI-ජනනය කරන ලද ලෙස පැහැදිලිව ලේබල් කර ඇත.

අපි භාවිතා කරන ආකෘති

ආකෘතියසඳහා භාවිතා කරයිබලපත්‍රයක්‍රියාත්මක වේ
Whisper large-v3-turbo (faster-whisper)පරිවර්තනය (පෙරනිමි)MITඅපගේ GPU
STT.ai Enhanced (custom fine-tune)පරිවර්තනය (ගෙවීම් සැලසුම්)MIT (base) / Proprietary (fine-tune weights)අපගේ GPU
Voskසැබෑ-කාලය වචන ධාරාවApache 2.0අපගේ GPU
SpeechBrain ECAPA-TDNNකථානායක diarizationApache 2.0අපගේ GPU
MadLAD-400 3Bපරිවර්තනය (450+ භාෂා)Apache 2.0අපගේ GPU
Qwen2.5-1.5B (llama.cpp)සාරාංශය, විශ්ලේෂණය, අන්තර්ගතය ජනනය, RAG කතාබස්Apache 2.0අපගේ GPU
F5-TTSහඬ ක්ලෝන / පෙළ-කථාවMITඅපගේ GPU
all-MiniLM-L6-v2RAG සෙවුම් සඳහා embeddingsApache 2.0අපගේ GPU

අපි OpenAI, Anthropic, Google Cloud, හෝ ඕනෑම විශේෂාංගයක් සඳහා ඕනෑම තෙවන පාර්ශවීය LLM API කතා කරන්නේ නැහැ. ඉහත සෑම ආකෘතියක්ම අපි අයිති හා ක්රියාත්මක දෘඩාංග මත ධාවනය වේ. අපි භාවිතා කරන එකම බාහිර AI සේවාව UI strings පරිවර්තනය සඳහා translateapi.ai (ද Muddy Holdings) වේ - මෙම ඔබේ පරිවර්තනය අන්තර්ගතය ස්පර්ශ කරන්නේ නැහැ.

අපි AI පරම්පරාව හෙළි කරන ආකාරය

  • HTML පිටු පරිවර්තනය කරන්න: ඇතුළත් <meta නම =\
  • පෙළ අපනයන (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): සෑම ගොනුවක් ඉහළ කොටසේ 'AI-උත්පාදනය පරිවර්තනය' හිස් පේළියක් ඇතුළත්.
  • සංයුක්ත හඬ / TTS ප්රතිදානය: WAV ගොනු මෙටා දත්ත හා බාගත පිටුව මත පැහැදිලි දැනුම් දී 'සංයෝජනය-හඬ' ටැග් ඇතුළත් වේ. ශ්රව්ය වගකීම් විරහිත මාර්ග සිතියම මත වේ.
  • API ප්රතිචාර: ඇත්ත ක්ෂේත්රය: පරිවර්තනය අන්තර්ගතය අඩංගු වන සෑම JSON ප්රතිචාරයක් තුළ _ai_generated ඇතුළත්.

පුහුණු දත්ත

  • මූලික ආකෘති (විස්පර්, MadLAD, Qwen, ආදිය) ඔවුන්ගේ අදාළ ප්රකාශකයන්ගෙන් පෙර පුහුණු පැමිණේ. අපි නැව්ගත කිරීම ලෙස ඔවුන් භාවිතා.
  • ඔයාගේ පිටපත් පාවිච්චි වෙන්නේ නෑ මූලික ආකෘති පුහුණු කරන්න.
  • ඔබ පරිවර්තනය කොටසක් නිවැරදි නම් (පැන්සල් අයිකනය) හෝ එය වැරදි සලකුණු (ධජය අයිකනය), ඔබ / පෞද්ගලිකත්ව-සංරචක / දී තෝරා ඇත (\
  • වෙන් වෙන්වම, ශ්රව්ය රසායනාගාරය සඳහා නිවැරදි කිරීම් සහ ශ්රව්ය දායකත්වයට දායක වන්න (/privacy-settings/ හි ද, ද පෙරනිමියෙන් අක්රිය) ඔබ නිවැරදි කොටස් ශ්රව්ය දායකත්වයට ඔබ තෝරා, නිවැරදි පෙළ සමග යුගල, CC-BY-SA-4.0 යටතේ අපගේ ශ්රව්ය රසායනාගාරය දත්ත කට්ටලයට. මෙම දෙකම ස්වාධීන වේ - ඔබ එකක් හෝ ලබා දිය හැකිය, දෙකම, හෝ දෙකම.
  • ඔබ අප් ලෝඩ් ශ්රව්ය තුළ මකා දමයි 24 cleanup_uploads cron හරහා පැය — ඔබ තෝරා නොමැති නම් \

නිරවද්යතාවය සහ දෝෂ

AI පරිවර්තනය පරිපූර්ණ නොවේ. වචනය දෝෂ අනුපාත කථානායක උච්චාරණය, ශ්රව්ය ගුණාත්මක, භාෂාව, සහ ඩොමේන් වචන සංඛ්යාව අනුව වෙනස් වේ. වැදගත් භාවිතය සඳහා (නීතිමය, වෛද්ය, රෙගුලාසි කර්මාන්ත) මුල් ශ්රව්ය එරෙහිව තහවුරු. අපේ මහජන WER ආකෘතියකට අනුව සංගුණක දී /models/.

අනුකූලතා ප්රශ්න

යුරෝපා සංගමයේ AI පනත සඳහා, GDPR, හෝ වෙනත් අනුකූල ප්රශ්න: hello@stt.ai හෝ භාවිතා කරන්න සම්බන්ධතා ආකෘතිය.

අවසන් යාවත්කාලීන කිරීම: 2026-04-26.