AI politika ir skaidrumas
Ką AI naudojame, kur veikia, ir kaip mes laikomės informacijos atskleidimo reikalavimų (ES AIS akto 50 straipsnis, galiojantis 2026-08-02).
TL;DR
- Visi stenogramos yra AI-sukurtas. Kiekvienas išvestis turi mašininio nuskaitomojo atskleidimo.
- Visi AI veikia mūsų pačių GPU. Mes ne siųsti savo garso ar tekstą į OpenAI, Antropic, "Google", ar bet kurios trečiosios šalies LLM API.
- Mes netreniruojame jūsų stenogramose esančių modelių. Tik pasirinkus smulkų kursą, naudojami jūsų aiškiai padaryti pataisymai.
- Sintetiniai balso klonai (TTS) yra aiškiai pažymėti kaip AI sukurtas failo pavadinimas, metaduomenys ir puslapyje.
Modeliai, kuriuos naudojame
| Pavyzdys | Naudojamas | Licencija | Vyksta toliau |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Perraša (numatyta) | MIT | Mūsų VPU |
| STT.ai Enhanced (custom fine-tune) | Perraša (mokami planai) | MIT (base) / Proprietary (fine-tune weights) | Mūsų VPU |
| Vosk | Tikrojo laiko žodžio srautavimas | Apache 2.0 | Mūsų VPU |
| SpeechBrain ECAPA-TDNN | Garsiakalbių diarizacija | Apache 2.0 | Mūsų VPU |
| MadLAD-400 3B | Vertimas (450+ kalbomis) | Apache 2.0 | Mūsų VPU |
| Qwen2.5-1.5B (llama.cpp) | Santrauka, analizė, turinio generavimas, RAG pokalbiai | Apache 2.0 | Mūsų VPU |
| F5-TTS | Balso klonavimas / tekstas į garsą | MIT | Mūsų VPU |
| all-MiniLM-L6-v2 | Įterpiami RPG paieškos elementai | Apache 2.0 | Mūsų VPU |
Mes neskambiname OpenAI, Anthropic, Google Cloud, ar bet kokios trečiosios šalies LLM API bet kokiai funkcijai. Kiekvienas modelis veikia ant aparatūros mes turime ir veikia. Vienintelis išorinis AI paslauga, kurią naudojame, yra Translateapi.ai (taip pat Muddy Holdings) versti UI stygas - tai niekada paliečia jūsų transliuotas turinį.
Kaip mes atskleisti AI karta
- Perrašymo HTML puslapiai: < Meta name=\
- Tekstas eksportas (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): kiekvieno failo viršuje yra „AI sukurto stenogramos“ antraštė.
- Sintetinis balsas / TTS išvestis: WAV failai apima "sintetinis balso" žymę metaduomenys ir aiškus pranešimas atsisiuntimo puslapyje. Garsus atsisakymas yra veiksmų plane.
- API atsakas: įtraukti _ai_sukurtas: tikrasis laukas kiekviename JSON atsake, kuriame yra transtraced turinys.
Mokymo duomenys
- Baziniai modeliai (Whisper, MadLAD, Qwen ir t.t.) iš anksto parengti iš jų leidėjų. Mes naudojame juos kaip laivyba.
- Jūsų stenogramos NEGALIMA treniruoti bazinių modelių.
- Jei taisyti transkripto segmentą ( pieštuko piktogramą) arba pažymėti jį neteisingai (kodo piktogramą), o jūs pasirinkote ties / privacy nustatymus / (\
- Atskirai, Prisidėti pataisymai plius garso į Voice Lab toggle (taip pat /privacy-settings /, taip pat default off) pasirenka jums prisidėti prie garso segmentų jums ištaisyti, sujungti su pataisytu tekstu, į mūsų Balso Lab duomenų rinkinį pagal CC-BY-SA-4.0. Du perjungimai yra nepriklausomi – jūs galite suteikti tiek, arba nei.
- Audio, įkelkite, ištrinami per 24 valandas per valymo_uploads Cron — UNLESS jums pasirinko \
Tikslumas ir klaidos
AI transkripcija nėra tobula. Žodinis klaidų lygis skiriasi pagal garsiakalbio akcentą, garso kokybę, kalbą ir domeno žodyną. Kritiniam naudojimui (teisinis, medicinos, reguliuojamos pramonės šakos) patikrinti pagal originalų garsą. Mūsų vieši WER lyginamieji pagal modelį yra: /models/.
Atitikties klausimai
ES PG akto, BDAR ar kitų atitikties klausimų atveju: hello@stt.ai arba naudoti Kontaktinė forma.
Paskutinis atnaujinimas: 2026-04-26.