A belső piaci politika és átláthatóság
Mit használunk az MI-vel, hol fut, és hogyan felelünk meg a közzétételi követelményeknek (az EU AI-törvény 50. cikke, tényleges 2026-08-02).
TL;DR
- Minden átirat mesterséges mesterséges, minden kimeneten van egy gépileg olvasható közzététel.
- Minden MI fut a saját GPU. Nem küldjük el audió vagy szöveg OpenAI, Anthropic, Google, vagy bármely harmadik fél LLM API.
- Nem csinálunk vonat bázis modellek a átiratok. Csak egy opt-in finomhangú használja javítások kifejezetten.
- Szintetikus hang klónok (TTS) egyértelműen címkézett AI-generált fájlnév, metaadatok, és az oldalon.
A használt modellek
| Minta | A következő betegségek esetén alkalmazható: | Engedély | Futás! |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Átírás (alapértelmezett) | MIT | A GPU-nk |
| STT.ai Enhanced (custom fine-tune) | Átírás (fizetett tervek) | MIT (base) / Proprietary (fine-tune weights) | A GPU-nk |
| Vosk | Valós idejű szófolyamozás | Apache 2.0 | A GPU-nk |
| SpeechBrain ECAPA-TDNN | Hangszóródiarizáció | Apache 2.0 | A GPU-nk |
| MadLAD-400 3B | Fordítás (450+ nyelvek) | Apache 2.0 | A GPU-nk |
| Qwen2.5-1.5B (llama.cpp) | Összefoglalás, elemzés, tartalomtermelés, RTI-csevegés | Apache 2.0 | A GPU-nk |
| F5-TTS | Hang klónozás / szöveg-beszélgetés | MIT | A GPU-nk |
| all-MiniLM-L6-v2 | Az RTI-kereséshez szükséges ágyneműk | Apache 2.0 | A GPU-nk |
Nem hívjuk OpenAI, Anthropic, Google Cloud, vagy bármely harmadik fél LLM API-t bármilyen funkcióhoz. Minden fenti modell saját hardverrel működik. Az egyetlen külső MI szolgáltatás, amit használunk, az a fordítói.ai (más néven Muddy Holdings) az UI húrok fordításához • ez soha nem érinti a transzcribed tartalmat.
Hogyan hozzuk nyilvánosságra az AI generációt?
- Fordítás HTML oldalak: <meta név =\
- Szövegexport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): minden fájl tetején tartalmaz egy "AI-generált átirat" fejlécet.
- Szintetikus hang / TTS kimenet: A WAV fájlok metaadatban egy "szintetikus hang" címkét és egy egyértelmű értesítést tartalmaznak a letöltési oldalon. Az audio-visszamondás az útitervben található.
- API válaszok: tartalmaz egy _ai_generált: igaz mező minden JSON válasz, amely tartalmazza a átírt tartalmat.
Képzési adatok
- Alapmodellek (Whisper, MadLAD, Qwen, stb.) saját kiadóiktól származnak, amelyeket hajósként használunk.
- A leiratait NEM használják alapmodellek kiképzéséhez.
- Ha kijavít egy átirati szegmenst (a ceruza ikont) vagy helytelen jelölést (a zászló ikont), és a /privacy-beállítások mellett döntött (\)
- Külön-külön, a Hozzájáruló korrekció plusz hang a Voice Lab toggle (is a /privacy-settings/, is alapértelmezés ki) azt választja, hogy járuljon hozzá a hangszegmensek, a helyes, párosított szöveg, a Voice Lab adatbázis CC-BY-SA-4.0.
- A feltöltött hangokat 24 órán belül töröljük a takarítás_feltöltések ~ UNLESS által választott \
Pontosság és hibák
AI transzkripció nem tökéletes. A szóhiba aránya változik a hangszóró akcentusa, hangminősége, nyelve, és a domain szókincse. Kritikus használatra (jogi, orvosi, szabályozott iparágak) ellenőrizze az eredeti audio. A nyilvános WER referenciaértékek modellenként a /models/.
Megfelelési kérdések
Az EU MI-törvénye, GDPR-je vagy egyéb megfelelési kérdések esetében: hello@stt.ai vagy a kapcsolatfelvételi űrlap.
Utolsó frissítés: 2026-04-26.