Sharciga AI & Shaandhaynta
Waa maxay AI aan isticmaalno, halka ay socoto, iyo sida aan u raacno shuruudaha shaacinta (EU AI Act Qaybta 50, 2026-08-02).
TL;DR
- Dhammaan transcripts waa AI-soo saaro. Wax soo saarka kasta oo qaado shaacin mashiinka akhris.
- AI oo dhan waxay ku socdaan GPU-yadayaga. Waxaanan u diri karin codkaaga ama qoraalka OpenAI, Anthropic, Google, ama wax kasta oo saddexaad LLM API.
- Waxaan u baahanahay in aan tababaraan qaababka salka ku ah qoraaladaada. kaliya opt-in fine-tune isticmaalaa hagaajinta aad si cad u sameeyaan.
- Synthetic codka klones (TTS) waa si cad u calaamadsan sida AI-soo saaro in filename, metadata, iyo on page.
Models aan isticmaalno
| Nooc | La isticmaalayo | Liisan | Ku socda |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Qoraal (default) | MIT | GPU-yada |
| STT.ai Enhanced (custom fine-tune) | Qoraalka (plans la bixiyo) | MIT (base) / Proprietary (fine-tune weights) | GPU-yada |
| Vosk | Wareegta ereyga waqti-dhab ah | Apache 2.0 | GPU-yada |
| SpeechBrain ECAPA-TDNN | Qof-dheer | Apache 2.0 | GPU-yada |
| MadLAD-400 3B | Tarjumaadda (450+ luqadood) | Apache 2.0 | GPU-yada |
| Qwen2.5-1.5B (llama.cpp) | Faahfaahin, falanqaynta, abuurista content, RAG chat | Apache 2.0 | GPU-yada |
| F5-TTS | Dhaqdhaqaaqa codka / qoraal-in-dhaqaaq | MIT | GPU-yada |
| all-MiniLM-L6-v2 | Embeddings for RAG search | Apache 2.0 | GPU-yada |
Waxaanan u yeedhay OpenAI, Anthropic, Google Cloud, ama mid kasta oo saddexaad LLM API feature kasta. Mid kasta oo ka mid ah qaababka kor ku xusan ku socda qalabka aan leenahay iyo hawlgalka. adeegga AI oo kaliya ee dibadda ah ee aan isticmaalno waa translateapi.ai (iyo Muddy Holdings) si loo turjumayo UI strings - tani ma taabtaan content aad ku qortay.
Sida aan u muujinno AI dhalasho
- Tusaale HTML: ku dar <meta magac=\
- Qoraalka dhoofinta (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ku jiraan 'AI-soo saaro transcript' line madaxa ee korka fayl kasta.
- Codka isku dhafan / TTS soosaarka: Faylasha WAV waxaa ka mid ah'synthetic-voice' tag in metadata iyo ogeysiis cad oo ku saabsan bogga soo dejinta. Audible diidmada waa ku saabsan qorshaha socda.
- Jawaabihii API: ku dar _ai_generated: dhab ah ee goobta jawaab kasta oo JSON oo ku jira waxyaabaha la qoray.
Macluumaadka Tababarka
- Base models (Whisper, MadLAD, Qwen, iwm) yimaadaan hore-ku tababaran ka soo daabacaadda ka mid ah. Waxaan u isticmaali sida-shipped.
- Your transcripts ma aha in la isticmaalo si ay u tababaraan qaababka base.
- Haddii aad saxdo qaybta qoraalka (laab-laab icon) ama calaamad u qalad ah (laab-laab icon), IYO aad dooratay in at /privacy-settings/ (\
- Si gaar ah, Contribute corrections plus audio to Voice Lab toggle (oo sidoo kale ku yaal /privacy-settings/, sidoo kale default off) wuxuu kuu ogolaanayaa inaad ku bixiso maqalka qaybaha aad saxdo, oo la xiriira qoraalka la hagaajiyey, si aan u helno xogta Voice Lab ee CC-BY-SA-4.0. Labada toggles waa madaxbannaan — waxaad siin kartaa mid, labadaba, ama midnaba.
- Audio aad soo dejisan waxaa la tirtiraa gudahood 24 saacadood oo ka socda cleanup_uploads cron — haddii aad dooratay in ay \
Xaq iyo khaladaad
AI qoraalka ma aha mid buuxa. Word khaladaadka rates kala duwan yihiin iyadoo la isticmaalayo afka, tayada audio, afka, iyo domain afka. Si loo isticmaalo muhiim ah (dhaqanka, caafimaadka, warshadaha la xakameeyay) xaqiijin ka dhan ah audio asalka ah. Our WER guud benchmarks per model waa at /models/.
Su'aalaha waafaqsan
Xeerka EU AI, GDPR, ama su'aalaha kale ee waafaqsanaanta: hello@stt.ai ama isticmaal xiriirka foomka.
La cusbooneysiiyay: 2026-04-26.