Politika AI a transparentnosť
Akú umelú inteligenciu používame, kde sa používako dodržiavame požiadavky na zverejňovanie (článok 50 zákona EÚ o umelej inteligencii, účinný od 2. augusta 2026).
TL;DR
- Všetky prepisy sú generované AI. Každý výstup nesie strojovo čitateľné zverejnenie.
- Všetky AI beží na našom vlastnom GPU, NEPOSIELAME váš zvuk alebo text do OpenAI, Anthropic, Google alebo akéhokoľvek API LLM tretej strany.
- NEBUDEME trénovať základné modely na vašich prepisoch, iba opt-in fine-tuning používa korekcie, ktoré explicitne urobíte.
- Syntetické hlasové klony (TTS) sú jasne označené ako generované umelou inteligenciou v názve súboru, metadátach a na stránke.
Modely, ktoré používame
| Model | Používa sa na | Licencia | Beží na |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Prepis (predvolené) | MIT | Naše grafické karty |
| STT.ai Enhanced (custom fine-tune) | Prepis (platené plány) | MIT (base) / Proprietary (fine-tune weights) | Naše grafické karty |
| Vosk | Real-time slovo streaming | Apache 2.0 | Naše grafické karty |
| SpeechBrain ECAPA-TDNN | Diarizácia reproduktorov | Apache 2.0 | Naše grafické karty |
| MadLAD-400 3B | Preklad (450+ jazykov) | Apache 2.0 | Naše grafické karty |
| Qwen2.5-1.5B (llama.cpp) | Zhrnutie, analýza, tvorba obsahu, RAG chat | Apache 2.0 | Naše grafické karty |
| F5-TTS | Klonovanie hlasu / text-to-speech | MIT | Naše grafické karty |
| all-MiniLM-L6-v2 | Embeddings for Vyhľadávanie RAG | Apache 2.0 | Naše grafické karty |
Nepoužívame OpenAI, Anthropic, Google Cloud, ani žiadne API LLM tretích strán pre žiadnu funkciu.Každý model vyššie beží na hardvéri, ktorý vlastníme a prevádzkujeme. Jediná externá služba AI, ktorú používame, je translateapi.ai (tiež Muddy Holdings) na preklad reťazcov UI - to sa nikdy nedotkne vášho prepísaného obsahu.
Ako zverejňujeme generovanie umelej inteligencie
- Prepis HTML stránok: Zahrnúť <meta name=\
- Export textu (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): zahrnúť riadok hlavičky „AI-generovaný prepis“ v hornej časti každého súboru.
- Syntetický hlas / TTS výstup: Súbory WAV obsahujú v metadátach značku „syntetický hlas“ a na stránke na stiahnutie je jasné upozornenie.
- Odpovede API: Do každej odpovede JSON, ktorá obsahuje prepísaný obsah, zahrňte pole _ai_generated: true.
Údaje o tréningu
- Základné modely (Whisper, MadLAD, Qwen, atď.) sú predtrénované od ich príslušných vydavateľov a používame ich tak, ako sú.
- Vaše prepisy sa nepoužívajú na trénovanie základných modelov.
- Ak opravíte segment prepisu (ikona ceruzky) alebo ho označíte ako nesprávny (ikona vlajky) A prihlásili ste sa na /privacy-settings/ (\
- Samostatne, prepínač Contribute corrections plus audio to Voice Lab (tiež v /privacy-settings/, tiež štandardne vypnutý) vám umožní prispieť zvukom segmentov, ktoré opravíte, spolu s opraveným textom, do našej súpravy údajov Voice Lab pod licenciou CC-BY-SA-4.0. Tieto dva prepínače sú nezávislé — môžete udeliť buď jedno, alebo oboje, alebo ani jedno.
- Audio, ktoré nahráte, je vymazané do 24 hodín pomocou cleanup_uploads cron — POKIAĽ ste sa neprihlásili do \
Presnosť a chyby
Miera chýb slov sa líši v závislosti od prízvuku rečníka, kvality zvuku, jazyka a slovnej zásoby domény. Pre kritické použitie (právne, lekárske, regulované odvetvia) overte proti pôvodnému zvuku. /models/.
Otázky týkajúce sa dodržiavania predpisov
Pre otázky týkajúce sa zákona EÚ o umelej inteligencii, nariadenia GDPR alebo iných otázok týkajúcich sa súladu: hello@stt.ai Alebo použite Kontaktný formulár -.
Posledná aktualizácia: 2018 2026-04-26.