AI politika i transparentnost
Što koristimo, gdje radi, i kako se poštuje zahtjevima za objavljivanje (Članak 50 Zakona EU-a o IU-u, koji stupa na snagu 2026-08-02).
TL;DR
- Svi transkripti su stvoreni od AI-a, svaki izlaz ima automatski čitljivu objavu.
- Svi AL radi na vlastitom GPU. NE šaljemo vaš audio ili tekst OpenAI, Antropic, Google, ili bilo koji treće strane LLM API.
- NE treniramo modele baze na svojim transkriptama. Samo opt-in-tone koristite korekcije koje izričito napravite.
- Sintetički glasovni klonovi (TTS) jasno su označeni kao AI generirani u datoteci, metapodaci i na stranici.
Modeli koje koristimo
| Uzorak | Koristi se za | Dozvola | Pokreće se |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transcription (uobičajeno) | MIT | Naš GPU |
| STT.ai Enhanced (custom fine-tune) | Prepisivanje (plaćeni planovi) | MIT (base) / Proprietary (fine-tune weights) | Naš GPU |
| Vosk | Realnovremensko streaming riječi | Apache 2.0 | Naš GPU |
| SpeechBrain ECAPA-TDNN | Dijarizacija zvučnika | Apache 2.0 | Naš GPU |
| MadLAD-400 3B | Prijevod (450+ jezika) | Apache 2.0 | Naš GPU |
| Qwen2.5-1.5B (llama.cpp) | Sažetak, analiza, proizvodnja sadržaja, RAG chat | Apache 2.0 | Naš GPU |
| F5-TTS | Glasno kloniranje / tekst-na-špik | MIT | Naš GPU |
| all-MiniLM-L6-v2 | Ugrađena za pretragu RAG | Apache 2.0 | Naš GPU |
Ne zovemo OpenAI, Antropic, Google Cloud, ili bilo koju trećoj stranici LLM API za bilo koju funkciju. Svaki model iznad radi na hardveru koji posjedujemo i djelujemo. Jedini vanjski AI servis koji koristimo je translateapi.ai (također Muddy Holdings) za prevođenje UI strune – to nikada ne dodiruje transcribirani sadržaj.
Kako otkrijemo AI generaciju
- Transcript HTML stranice: uključi <meta name=\
- Izvoz teksta (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Uključuju "AI-generiran transkript" liniju na vrhu svakog dosjea.
- Sintetički glas / TTS izlaz: WAV datoteke uključuju oznaku'syntetički glas' u metapodacima i jasno obavijest na stranici preuzimanja. Čuveno izricanje izgovora je na mapi.
- API odgovori: uključi _ai_generirano: pravo polje u svakom JSON odgovoru koji sadrži transkriptički sadržaj.
Podaci o treningu
- Bazni modeli (Whisper, MadLAD, Qwen, itd.) dolaze unaprijed obučeni od njihovih izdavača. Mi ih koristimo kao brod.
- Vaši transkripti se ne koriste za trening modela baze.
- Ako ispravite transkriptni segment (ikona olovke) ili ga označite netočnim (ikona zastave), I odlučili ste se na /nastaviti privatnost / (\
- Odvojeno, Popravke suradnje plus audio u Voice Lab prekidač (također na /privacy-settings /, također uobičajeno isključeno) odabira vas u doprinošenju zvuka segmenta koje ispravite, u paru s ispravljenim tekstom, na naš Glass Lab set podataka pod CC-BY-SA-4.0. Dva preklopnika su nezavisna — možete odobriti ili oboje, ili niti jedno.
- Audio koji ste upisali briše se u roku od 24 sata putem cistka_uploads cron — NEMA DOK ste odlučili da \
Preciznost i pogreške
AI transkripcija nije savršena. Stope pogreške riječi varira prema naglasku govornika, audio kvaliteti, jeziku i domeni rječnik. Za kritičnu upotrebu (legal, medicinski, regulirani industrija) provjeriti protiv originalnog audio. Naši javni WER mjerila po modelu su na /models/.
Upitavanja o sukladnosti
Za Zakon EU-a o AL-u, GDPR-u ili druga pitanja o usklađenosti: hello@stt.ai ili koristiti obrasac za kontakt.
Zadnje ažuriranje: 2026-04-26.