A belső piaci politika és átláthatóság

Mit használunk az MI-vel, hol fut, és hogyan felelünk meg a közzétételi követelményeknek (az EU AI-törvény 50. cikke, tényleges 2026-08-02).

TL;DR

  • Minden átirat mesterséges mesterséges, minden kimeneten van egy gépileg olvasható közzététel.
  • Minden MI fut a saját GPU. Nem küldjük el audió vagy szöveg OpenAI, Anthropic, Google, vagy bármely harmadik fél LLM API.
  • Nem csinálunk vonat bázis modellek a átiratok. Csak egy opt-in finomhangú használja javítások kifejezetten.
  • Szintetikus hang klónok (TTS) egyértelműen címkézett AI-generált fájlnév, metaadatok, és az oldalon.

A használt modellek

MintaA következő betegségek esetén alkalmazható:EngedélyFutás!
Whisper large-v3-turbo (faster-whisper)Átírás (alapértelmezett)MITA GPU-nk
STT.ai Enhanced (custom fine-tune)Átírás (fizetett tervek)MIT (base) / Proprietary (fine-tune weights)A GPU-nk
VoskValós idejű szófolyamozásApache 2.0A GPU-nk
SpeechBrain ECAPA-TDNNHangszóródiarizációApache 2.0A GPU-nk
MadLAD-400 3BFordítás (450+ nyelvek)Apache 2.0A GPU-nk
Qwen2.5-1.5B (llama.cpp)Összefoglalás, elemzés, tartalomtermelés, RTI-csevegésApache 2.0A GPU-nk
F5-TTSHang klónozás / szöveg-beszélgetésMITA GPU-nk
all-MiniLM-L6-v2Az RTI-kereséshez szükséges ágyneműkApache 2.0A GPU-nk

Nem hívjuk OpenAI, Anthropic, Google Cloud, vagy bármely harmadik fél LLM API-t bármilyen funkcióhoz. Minden fenti modell saját hardverrel működik. Az egyetlen külső MI szolgáltatás, amit használunk, az a fordítói.ai (más néven Muddy Holdings) az UI húrok fordításához • ez soha nem érinti a transzcribed tartalmat.

Hogyan hozzuk nyilvánosságra az AI generációt?

  • Fordítás HTML oldalak: <meta név =\
  • Szövegexport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): minden fájl tetején tartalmaz egy "AI-generált átirat" fejlécet.
  • Szintetikus hang / TTS kimenet: A WAV fájlok metaadatban egy "szintetikus hang" címkét és egy egyértelmű értesítést tartalmaznak a letöltési oldalon. Az audio-visszamondás az útitervben található.
  • API válaszok: tartalmaz egy _ai_generált: igaz mező minden JSON válasz, amely tartalmazza a átírt tartalmat.

Képzési adatok

  • Alapmodellek (Whisper, MadLAD, Qwen, stb.) saját kiadóiktól származnak, amelyeket hajósként használunk.
  • A leiratait NEM használják alapmodellek kiképzéséhez.
  • Ha kijavít egy átirati szegmenst (a ceruza ikont) vagy helytelen jelölést (a zászló ikont), és a /privacy-beállítások mellett döntött (\)
  • Külön-külön, a Hozzájáruló korrekció plusz hang a Voice Lab toggle (is a /privacy-settings/, is alapértelmezés ki) azt választja, hogy járuljon hozzá a hangszegmensek, a helyes, párosított szöveg, a Voice Lab adatbázis CC-BY-SA-4.0.
  • A feltöltött hangokat 24 órán belül töröljük a takarítás_feltöltések ~ UNLESS által választott \

Pontosság és hibák

AI transzkripció nem tökéletes. A szóhiba aránya változik a hangszóró akcentusa, hangminősége, nyelve, és a domain szókincse. Kritikus használatra (jogi, orvosi, szabályozott iparágak) ellenőrizze az eredeti audio. A nyilvános WER referenciaértékek modellenként a /models/.

Megfelelési kérdések

Az EU MI-törvénye, GDPR-je vagy egyéb megfelelési kérdések esetében: hello@stt.ai vagy a kapcsolatfelvételi űrlap.

Utolsó frissítés: 2026-04-26.