AI Policy & Transparency

"What AI we use, where it runs, and how we comply with disclosure requirements" (EU AI Act Article 50, effective 2026-08-02).

TL;DR

  • Svi transkripti su generirani AI-om, svaki izlaz nosi mašinski čitljivu objavu.
  • Sve AI radi na našem vlastitom GPU-u. NE šaljemo vaš audio ili tekst OpenAI-u, Anthropic-u, Google-u, ili bilo kojem trećem LLM API-ju.
  • Ne učimo modele na vašim transkriptima, samo opt-in fine tuning koristi korekcije koje ste vi eksplicitno napravili.
  • Sintetički glasovni klonovi (TTS) su jasno označeni kao AI-generirani u imenu datoteke, metapodacima i na stranici.

Modeli koje koristimo

ModelKoristi se zaLicencaPokreće se
Whisper large-v3-turbo (faster-whisper)Transkripcija (uobičajeno)MITNaš GPU
STT.ai Enhanced (custom fine-tune)Transkripcija (plaćeni planovi)MIT (base) / Proprietary (fine-tune weights)Naš GPU
VoskReal time word streamingApache 2.0Naš GPU
SpeechBrain ECAPA-TDNNDijagnozaApache 2.0Naš GPU
MadLAD-400 3BPrevodi (450+ jezika)Apache 2.0Naš GPU
Qwen2.5-1.5B (llama.cpp)Sažetak, analiza, generiranje sadržaja, RAG chatApache 2.0Naš GPU
F5-TTSKloniranje glasa / tekst-u-govorMITNaš GPU
all-MiniLM-L6-v2Ugradnja za RAG pretraguApache 2.0Naš GPU

Ne koristimo OpenAI, Anthropic, Google Cloud, ili bilo koji LLM API treće strane za bilo koju funkciju. Svaki model gore radi na hardveru koji posjedujemo i kojim upravljamo. Jedini vanjski AI servis koji koristimo je translateapi.ai (također Muddy Holdings) za prevođenje UI stringova - ovo nikad ne dodiruje vaš transkripirani sadržaj.

Kako otkrivamo AI generaciju

  • HTML stranice: include <meta name=\
  • Izvoz teksta (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): uključi liniju zaglavlja 'AI-generirani transkript' na vrhu svake datoteke.
  • Sintetički glas / TTS izlaz: WAV datoteke uključuju oznaku'sintetički glas' u metapodacima i jasnu obavijest na stranici za preuzimanje. Zvučni odricanje je na planu.
  • API odgovori: uključi polje _ai_generated: true u svaki JSON odgovor koji sadrži transkripirani sadržaj.

Podaci o treningu

  • Osnovni modeli (Whisper, MadLAD, Qwen, itd.) dolaze unaprijed obučeni od njihovih izdavača. Koristimo ih kao što su isporučeni.
  • Vaši transkripti se ne koriste za trening modela.
  • Ako ispravljate segment transkripta (ikona olovke) ili ga označite kao neispravan (ikona zastavice), I ako ste se prijavili u /privacy-settings/ (\
  • Zasebno, opcija Pridonesi ispravke i zvuk u Voice Lab (također u /privacy-settings/, također po defaultu isključena) vas uključuje u doprinos zvuka segmenata koje ispravite, zajedno s ispravljenim tekstom, našem skupu podataka Voice Lab pod CC-BY-SA-4.0. Ove dvije opcije su nezavisne — možete odobriti bilo koju, obje ili ni jednu.
  • Audio koji prenesete se briše u roku od 24 sata putem cleanup_uploads cron — AKO NISTE odabrali \

Tačnost i greške

AI transkripcija nije savršena. Stope grešaka u riječima variraju ovisno o naglasku govornika, kvalitetu zvuka, jeziku i vokabularu domene. Za kritičnu upotrebu (pravne, medicinske, regulirane industrije) provjerite sa originalnim zvukom. Naše javne WER referentne vrijednosti po modelu su na /models/.

Pitanja o usklađenosti

Za EU AI Act, GDPR, ili druga pitanja o usklađenosti: hello@stt.ai ili koristi kontaktni obrazac.

Zadnja izmjena: 2026-04-26.