Polisi a Thryloywder AI

Pa AI rydym yn ei ddefnyddio, ble mae'n rhedeg, a sut rydym yn cydymffurfio â gofynion datgelu (Atodlen 50 o Ddeddf AI yr UE, yn berthnasol 2026-08-02).

TL;DR

  • Mae pob trosysgrif yn cael ei chreu gan AI. Mae gan bob allbwn gyhoeddiad darllenadwy gan y peiriant.
  • Mae pob AI yn rhedeg ar ein GPU ein hunain. DYW'N NI ddim yn anfon eich sain neu destun i OpenAI, Anthropic, Google, neu unrhyw API LLM trydydd parti.
  • Ni ydym yn hyfforddi modelau sylfaenol ar eich traethodau. Dim ond addasiad manwl dewisol sy'n defnyddio cywiriadau rydych yn eu gwneud yn glir.
  • Mae cloniau llais synthetig (TTS) yn cael eu labelu'n glir fel rhai a gynhyrchwyd gan AI yn enw'r ffeil, metadatar y dudalen.

Modelau rydym yn eu defnyddio

ModelDefnyddir ar gyferTrwyddedRhedeg ar
Whisper large-v3-turbo (faster-whisper)TrosysgrifoMITEin GPU
STT.ai Enhanced (custom fine-tune)Trawssgrifiad (plannau talu)MIT (base) / Proprietary (fine-tune weights)Ein GPU
VoskLlif gair amser realApache 2.0Ein GPU
SpeechBrain ECAPA-TDNNDiareiddio siaradwrApache 2.0Ein GPU
MadLAD-400 3BCyfieithiad (450+ iaith)Apache 2.0Ein GPU
Qwen2.5-1.5B (llama.cpp)Crynodeb, dadansoddiad, creu cynnwys, sgwrs RAGApache 2.0Ein GPU
F5-TTSClonio llais / testun-i-lafarMITEin GPU
all-MiniLM-L6-v2Name=Gosodiadau CysawdNameApache 2.0Ein GPU

Ni ydym yn galw OpenAI, Anthropic, Google Cloud, neu unrhyw API LLM trydydd parti am unrhyw nodwedd. Mae pob model uchod yn rhedeg ar y caledwedd rydym yn berchen arno a'n gweithredu. Yr unig wasanaeth AI allanol yr ydym yn ei ddefnyddio yw translateapi.ai (a Muddy Holdings) ar gyfer cyfieithu llinynnau UI — ni fydd hyn byth yn cyffwrdd eich cynnwys wedi'i drosi.

Sut rydym yn datgelu cynhyrchu AI

  • Trosysgrifo tudalennau HTML: cynnwys <meta name=\
  • Allforio testun (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): cynnwys llinell pennawd 'trawssgrifiad a gynhyrchir gan AI' ar frig pob ffeil.
  • Allbwn llais synthetig / TTS: Mae ffeiliau WAV yn cynnwys tag'synthetic-voice' yn metadata a hysbysiad clir ar y dudalen lawrlwytho. Mae datganiad hawliau clywedol ar y map ffordd.
  • Ymateb API: cynnwys maes _ai_generated: true mewn pob ymateb JSON sy'n cynnwys cynnwys wedi'i drosi.

Data hyfforddi

  • Mae modelau sylfaenol (Whisper, MadLAD, Qwen, ac ati) yn dod wedi'u rhag-hyfforddi o'u cyhoeddwyr. Rydym yn eu defnyddio fel y maent yn cael eu danfon.
  • Nid yw' ch trosysgrifau yn cael eu defnyddio i hyfforddi modelau sylfaen.
  • Os ydych yn cywiro rhan o'r traethawd (y eicon pensil) neu'n ei farcio'n anghywir (y eicon baneri), A'ch bod wedi dewis yn /privacy-settings/ (\
  • Ar wahân, mae'r togl Cyfrannu cywiriadau ynghyd â sain i Lab Llywio (yn /privacy-settings/ hefyd, hefyd yn weithredol yn rhagosodedig) yn eich dewis i gyfrannu sain y rhannau rydych chi'n eu cywiro, ynghyd â'r testun cywir, i'n set ddata Lab Llywio o dan CC-BY-SA-4.0. Mae'r ddau togl yn annibynnol — gallwch roi naill ai un, y ddau, neu ddim.
  • Mae sain rydych yn ei lawrlwytho yn cael ei ddileu o fewn 24 awr drwy'r cron cleanup_uploads — ONI BYDOCH wedi dewis \

Cyflymder a gwallau

Nid yw trawsgrifiad AI yn berffaith. Mae cyfraddau gwallau geiriau yn amrywio yn ôl sain y siaradwr, ansawdd sain, iaith, a geirfa'r parth. Am ddefnydd pwysig (lleiafswm, meddygol, diwydiannau rheoledig) gwiriwch yn erbyn y sain wreiddiol. Mae ein meini prawf WER cyhoeddus ar gyfer pob model ar /models/.

Cwestiynau cydweddu

Am GDPR, neu gwestiynau cydymffurfio eraill: hello@stt.ai neu ddefnyddio'r Ffurflen Gyswllt.

Diweddarwyd ddiwethaf: 2026-04-26.