AI politika i transparentnost

Što koristimo, gdje radi, i kako se poštuje zahtjevima za objavljivanje (Članak 50 Zakona EU-a o IU-u, koji stupa na snagu 2026-08-02).

TL;DR

  • Svi transkripti su stvoreni od AI-a, svaki izlaz ima automatski čitljivu objavu.
  • Svi AL radi na vlastitom GPU. NE šaljemo vaš audio ili tekst OpenAI, Antropic, Google, ili bilo koji treće strane LLM API.
  • NE treniramo modele baze na svojim transkriptama. Samo opt-in-tone koristite korekcije koje izričito napravite.
  • Sintetički glasovni klonovi (TTS) jasno su označeni kao AI generirani u datoteci, metapodaci i na stranici.

Modeli koje koristimo

UzorakKoristi se zaDozvolaPokreće se
Whisper large-v3-turbo (faster-whisper)Transcription (uobičajeno)MITNaš GPU
STT.ai Enhanced (custom fine-tune)Prepisivanje (plaćeni planovi)MIT (base) / Proprietary (fine-tune weights)Naš GPU
VoskRealnovremensko streaming riječiApache 2.0Naš GPU
SpeechBrain ECAPA-TDNNDijarizacija zvučnikaApache 2.0Naš GPU
MadLAD-400 3BPrijevod (450+ jezika)Apache 2.0Naš GPU
Qwen2.5-1.5B (llama.cpp)Sažetak, analiza, proizvodnja sadržaja, RAG chatApache 2.0Naš GPU
F5-TTSGlasno kloniranje / tekst-na-špikMITNaš GPU
all-MiniLM-L6-v2Ugrađena za pretragu RAGApache 2.0Naš GPU

Ne zovemo OpenAI, Antropic, Google Cloud, ili bilo koju trećoj stranici LLM API za bilo koju funkciju. Svaki model iznad radi na hardveru koji posjedujemo i djelujemo. Jedini vanjski AI servis koji koristimo je translateapi.ai (također Muddy Holdings) za prevođenje UI strune – to nikada ne dodiruje transcribirani sadržaj.

Kako otkrijemo AI generaciju

  • Transcript HTML stranice: uključi <meta name=\
  • Izvoz teksta (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Uključuju "AI-generiran transkript" liniju na vrhu svakog dosjea.
  • Sintetički glas / TTS izlaz: WAV datoteke uključuju oznaku'syntetički glas' u metapodacima i jasno obavijest na stranici preuzimanja. Čuveno izricanje izgovora je na mapi.
  • API odgovori: uključi _ai_generirano: pravo polje u svakom JSON odgovoru koji sadrži transkriptički sadržaj.

Podaci o treningu

  • Bazni modeli (Whisper, MadLAD, Qwen, itd.) dolaze unaprijed obučeni od njihovih izdavača. Mi ih koristimo kao brod.
  • Vaši transkripti se ne koriste za trening modela baze.
  • Ako ispravite transkriptni segment (ikona olovke) ili ga označite netočnim (ikona zastave), I odlučili ste se na /nastaviti privatnost / (\
  • Odvojeno, Popravke suradnje plus audio u Voice Lab prekidač (također na /privacy-settings /, također uobičajeno isključeno) odabira vas u doprinošenju zvuka segmenta koje ispravite, u paru s ispravljenim tekstom, na naš Glass Lab set podataka pod CC-BY-SA-4.0. Dva preklopnika su nezavisna — možete odobriti ili oboje, ili niti jedno.
  • Audio koji ste upisali briše se u roku od 24 sata putem cistka_uploads cron — NEMA DOK ste odlučili da \

Preciznost i pogreške

AI transkripcija nije savršena. Stope pogreške riječi varira prema naglasku govornika, audio kvaliteti, jeziku i domeni rječnik. Za kritičnu upotrebu (legal, medicinski, regulirani industrija) provjeriti protiv originalnog audio. Naši javni WER mjerila po modelu su na /models/.

Upitavanja o sukladnosti

Za Zakon EU-a o AL-u, GDPR-u ili druga pitanja o usklađenosti: hello@stt.ai ili koristiti obrasac za kontakt.

Zadnje ažuriranje: 2026-04-26.