AI Policy & Transparency
"What AI we use, where it runs, and how we comply with disclosure requirements" (EU AI Act Article 50, effective 2026-08-02).
TL;DR
- Svi transkripti su generirani AI-om, svaki izlaz nosi mašinski čitljivu objavu.
- Sve AI radi na našem vlastitom GPU-u. NE šaljemo vaš audio ili tekst OpenAI-u, Anthropic-u, Google-u, ili bilo kojem trećem LLM API-ju.
- Ne učimo modele na vašim transkriptima, samo opt-in fine tuning koristi korekcije koje ste vi eksplicitno napravili.
- Sintetički glasovni klonovi (TTS) su jasno označeni kao AI-generirani u imenu datoteke, metapodacima i na stranici.
Modeli koje koristimo
| Model | Koristi se za | Licenca | Pokreće se |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transkripcija (uobičajeno) | MIT | Naš GPU |
| STT.ai Enhanced (custom fine-tune) | Transkripcija (plaćeni planovi) | MIT (base) / Proprietary (fine-tune weights) | Naš GPU |
| Vosk | Real time word streaming | Apache 2.0 | Naš GPU |
| SpeechBrain ECAPA-TDNN | Dijagnoza | Apache 2.0 | Naš GPU |
| MadLAD-400 3B | Prevodi (450+ jezika) | Apache 2.0 | Naš GPU |
| Qwen2.5-1.5B (llama.cpp) | Sažetak, analiza, generiranje sadržaja, RAG chat | Apache 2.0 | Naš GPU |
| F5-TTS | Kloniranje glasa / tekst-u-govor | MIT | Naš GPU |
| all-MiniLM-L6-v2 | Ugradnja za RAG pretragu | Apache 2.0 | Naš GPU |
Ne koristimo OpenAI, Anthropic, Google Cloud, ili bilo koji LLM API treće strane za bilo koju funkciju. Svaki model gore radi na hardveru koji posjedujemo i kojim upravljamo. Jedini vanjski AI servis koji koristimo je translateapi.ai (također Muddy Holdings) za prevođenje UI stringova - ovo nikad ne dodiruje vaš transkripirani sadržaj.
Kako otkrivamo AI generaciju
- HTML stranice: include <meta name=\
- Izvoz teksta (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): uključi liniju zaglavlja 'AI-generirani transkript' na vrhu svake datoteke.
- Sintetički glas / TTS izlaz: WAV datoteke uključuju oznaku'sintetički glas' u metapodacima i jasnu obavijest na stranici za preuzimanje. Zvučni odricanje je na planu.
- API odgovori: uključi polje _ai_generated: true u svaki JSON odgovor koji sadrži transkripirani sadržaj.
Podaci o treningu
- Osnovni modeli (Whisper, MadLAD, Qwen, itd.) dolaze unaprijed obučeni od njihovih izdavača. Koristimo ih kao što su isporučeni.
- Vaši transkripti se ne koriste za trening modela.
- Ako ispravljate segment transkripta (ikona olovke) ili ga označite kao neispravan (ikona zastavice), I ako ste se prijavili u /privacy-settings/ (\
- Zasebno, opcija Pridonesi ispravke i zvuk u Voice Lab (također u /privacy-settings/, također po defaultu isključena) vas uključuje u doprinos zvuka segmenata koje ispravite, zajedno s ispravljenim tekstom, našem skupu podataka Voice Lab pod CC-BY-SA-4.0. Ove dvije opcije su nezavisne — možete odobriti bilo koju, obje ili ni jednu.
- Audio koji prenesete se briše u roku od 24 sata putem cleanup_uploads cron — AKO NISTE odabrali \
Tačnost i greške
AI transkripcija nije savršena. Stope grešaka u riječima variraju ovisno o naglasku govornika, kvalitetu zvuka, jeziku i vokabularu domene. Za kritičnu upotrebu (pravne, medicinske, regulirane industrije) provjerite sa originalnim zvukom. Naše javne WER referentne vrijednosti po modelu su na /models/.
Pitanja o usklađenosti
Za EU AI Act, GDPR, ili druga pitanja o usklađenosti: hello@stt.ai ili koristi kontaktni obrazac.
Zadnja izmjena: 2026-04-26.