Polisi a Thryloywder AI
Pa AI rydym yn ei ddefnyddio, ble mae'n rhedeg, a sut rydym yn cydymffurfio â gofynion datgelu (Atodlen 50 o Ddeddf AI yr UE, yn berthnasol 2026-08-02).
TL;DR
- Mae pob trosysgrif yn cael ei chreu gan AI. Mae gan bob allbwn gyhoeddiad darllenadwy gan y peiriant.
- Mae pob AI yn rhedeg ar ein GPU ein hunain. DYW'N NI ddim yn anfon eich sain neu destun i OpenAI, Anthropic, Google, neu unrhyw API LLM trydydd parti.
- Ni ydym yn hyfforddi modelau sylfaenol ar eich traethodau. Dim ond addasiad manwl dewisol sy'n defnyddio cywiriadau rydych yn eu gwneud yn glir.
- Mae cloniau llais synthetig (TTS) yn cael eu labelu'n glir fel rhai a gynhyrchwyd gan AI yn enw'r ffeil, metadatar y dudalen.
Modelau rydym yn eu defnyddio
| Model | Defnyddir ar gyfer | Trwydded | Rhedeg ar |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Trosysgrifo | MIT | Ein GPU |
| STT.ai Enhanced (custom fine-tune) | Trawssgrifiad (plannau talu) | MIT (base) / Proprietary (fine-tune weights) | Ein GPU |
| Vosk | Llif gair amser real | Apache 2.0 | Ein GPU |
| SpeechBrain ECAPA-TDNN | Diareiddio siaradwr | Apache 2.0 | Ein GPU |
| MadLAD-400 3B | Cyfieithiad (450+ iaith) | Apache 2.0 | Ein GPU |
| Qwen2.5-1.5B (llama.cpp) | Crynodeb, dadansoddiad, creu cynnwys, sgwrs RAG | Apache 2.0 | Ein GPU |
| F5-TTS | Clonio llais / testun-i-lafar | MIT | Ein GPU |
| all-MiniLM-L6-v2 | Name=Gosodiadau CysawdName | Apache 2.0 | Ein GPU |
Ni ydym yn galw OpenAI, Anthropic, Google Cloud, neu unrhyw API LLM trydydd parti am unrhyw nodwedd. Mae pob model uchod yn rhedeg ar y caledwedd rydym yn berchen arno a'n gweithredu. Yr unig wasanaeth AI allanol yr ydym yn ei ddefnyddio yw translateapi.ai (a Muddy Holdings) ar gyfer cyfieithu llinynnau UI — ni fydd hyn byth yn cyffwrdd eich cynnwys wedi'i drosi.
Sut rydym yn datgelu cynhyrchu AI
- Trosysgrifo tudalennau HTML: cynnwys <meta name=\
- Allforio testun (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): cynnwys llinell pennawd 'trawssgrifiad a gynhyrchir gan AI' ar frig pob ffeil.
- Allbwn llais synthetig / TTS: Mae ffeiliau WAV yn cynnwys tag'synthetic-voice' yn metadata a hysbysiad clir ar y dudalen lawrlwytho. Mae datganiad hawliau clywedol ar y map ffordd.
- Ymateb API: cynnwys maes _ai_generated: true mewn pob ymateb JSON sy'n cynnwys cynnwys wedi'i drosi.
Data hyfforddi
- Mae modelau sylfaenol (Whisper, MadLAD, Qwen, ac ati) yn dod wedi'u rhag-hyfforddi o'u cyhoeddwyr. Rydym yn eu defnyddio fel y maent yn cael eu danfon.
- Nid yw' ch trosysgrifau yn cael eu defnyddio i hyfforddi modelau sylfaen.
- Os ydych yn cywiro rhan o'r traethawd (y eicon pensil) neu'n ei farcio'n anghywir (y eicon baneri), A'ch bod wedi dewis yn /privacy-settings/ (\
- Ar wahân, mae'r togl Cyfrannu cywiriadau ynghyd â sain i Lab Llywio (yn /privacy-settings/ hefyd, hefyd yn weithredol yn rhagosodedig) yn eich dewis i gyfrannu sain y rhannau rydych chi'n eu cywiro, ynghyd â'r testun cywir, i'n set ddata Lab Llywio o dan CC-BY-SA-4.0. Mae'r ddau togl yn annibynnol — gallwch roi naill ai un, y ddau, neu ddim.
- Mae sain rydych yn ei lawrlwytho yn cael ei ddileu o fewn 24 awr drwy'r cron cleanup_uploads — ONI BYDOCH wedi dewis \
Cyflymder a gwallau
Nid yw trawsgrifiad AI yn berffaith. Mae cyfraddau gwallau geiriau yn amrywio yn ôl sain y siaradwr, ansawdd sain, iaith, a geirfa'r parth. Am ddefnydd pwysig (lleiafswm, meddygol, diwydiannau rheoledig) gwiriwch yn erbyn y sain wreiddiol. Mae ein meini prawf WER cyhoeddus ar gyfer pob model ar /models/.
Cwestiynau cydweddu
Am GDPR, neu gwestiynau cydymffurfio eraill: hello@stt.ai neu ddefnyddio'r Ffurflen Gyswllt.
Diweddarwyd ddiwethaf: 2026-04-26.