Politika a transparentnost AI

Co používáme, kam běžíme, a jak dodržujeme požadavky na zveřejňování informací (článek 50 zákona EU o ochraně osobních údajů, s účinností 2026-08-02).

TL;DR

  • Všechny přepisy jsou vytvořené AI. Každý výstup nese strojově čitelné odhalení.
  • Všechny AI běží na našem vlastním GPU. Neposíláme váš zvuk nebo text na OpenAI, Antropic, Google, nebo žádné třetí strany LLM API.
  • Netrénujeme žádný model na vašich přepisech. Každý model, který spustíme, je off-the-shelf open-source model. Opravy, které výslovně provádíte, jsou shromažďovány pouze pokud se rozhodnete.
  • Syntetické hlasové klony (TTS) jsou jasně označeny jako AI generované v názvu souboru, metadat a na stránce.

Modely, které používáme

VzorPoužívá se proLicenceBěží dál.
Whisper large-v3-turbo (faster-whisper)Transkripce (přednastaveno)MITNaše GPU
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”Transkripce (placené plány)MITNaše GPU
VoskStreamování slov v reálném časeApache 2.0Naše GPU
SpeechBrain ECAPA-TDNNDiarizace reproduktorůApache 2.0Naše GPU
MadLAD-400 3BPřeklady (450+ jazyky)Apache 2.0Naše GPU
Qwen2.5-1.5B (llama.cpp)Shrnutí, analýza, tvorba obsahu, chat RAGApache 2.0Naše GPU
F5-TTSKlonování hlasu / text-to-speechMITNaše GPU
all-MiniLM-L6-v2Vkládání do vyhledávání RAGApache 2.0Naše GPU

?STT.ai Enhanced? je náš název produktu pro Whisper large-v3 běží na našem vlastním GPU. Není to vlastní model, jemné nebo vlastní hmotnosti? je to největší a nejpřesnější Whisper checkpoint. Je přesnější než výchozí Whisper velké-v3-turbo, a asi 1,5x pomalejší na diarizované práci, měřeno na našem vlastním hardwaru.

Nenazýváme OpenAI, Antropic, Google Cloud, nebo žádné třetí strany LLM API pro jakoukoli funkci. Každý výše uvedený model běží na hardware, které vlastníme a provozujeme. Jedinou externí AI službu používáme je translatapi.ai (také Muddy Holdings) pro překlad UI řetězců? To se nikdy nedotkne vašeho přepsaného obsahu.

Jak odhalíme generaci AI

  • Transcript HTML stránky: zahrnovat <meta name=\
  • Text export (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): v horní části každého souboru obsahuje záhlaví 'AI-generovaný přepis'.
  • Syntetický hlas / výstup TTS: WAV soubory obsahují'syntetický-hlasové' tag v metadatech a jasné upozornění na stránce stahování. Zvučné vyloučení odpovědnosti je na plánu.
  • Odpovědi API: obsahovat _ai_genered: true field v každé JSON odpovědi, která obsahuje transcripted obsah.

Údaje o odborné přípravě

  • Základní modely (Whisper, MadLAD, Qwen, atd.) přicházejí předem vyškoleni od jejich příslušných vydavatelů. Používáme je jako-lodí.
  • Vaše přepisy nejsou zvyklé trénovat základní modely.
  • Pokud opravíte ikonu (tužku) nebo ji označíte za nesprávnou (ikonu vlajky), a zvolili jste si v /privacy-setu/ ("Model Training" toggle, default off), může být pár (nepravý text → opravený text) shromážděn pro výcvik budoucího modelu opravy textu. Pouze textový pár Áká nikdy není tímto směrem používán okolní audio ÁAAA. Žádný takový model neexistuje dnes: páry jsou pouze uloženy, a nic, co jsme v současné době sloužíme, bylo vyškoleno na nich.
  • Samostatně, Příspěvkové opravy plus audio do hlasové laboratoře přepnout (také na /privacy-settings /, také default off) se rozhodnete přispět zvuk segmentů, které jste opravili, spárovali s opraveným textem, na náš Voice Lab soubor pod CC-BY-SA-4. Dva přepínače jsou nezávislé, můžete udělit buď obojí, nebo ani jedno.
  • Audio, které nahrajete, je smazáno do 24 hodin prostřednictvím cleakup_uploads cron UNLESS, které jste zvolili do \

Přesnost a chyby

Transkripce AI není perfektní. Rychlosti chyb slov se liší podle reproduktorů akcent, kvalita zvuku, jazyk, a doména slovní zásoba. Pro kritické použití (legální, lékařský, regulovaný průmysl) ověřit proti původnímu zvuku. Naše veřejné WER standardy na model jsou na /models/.

Otázky týkající se souladu

Pro AI zákon, GDPR nebo jiné otázky týkající se dodržování předpisů: hello@stt.ai nebo kontaktní formulář.

Poslední aktualizace: 2026-08-05.