AI poliitika ja läbipaistvus
Mida me kasutame, kus see töötab ja kuidas me täidame avalikustamisnõudeid (ELi AI seaduse artikkel 50, tõhus 2026-08-02).
TL; DR
- Kõik protokollid on tehisintellekti loodud, iga väljund sisaldab masinloetavat infot.
- Kõik AI töötab meie enda GPU. Me ei saada oma audio või teksti OpenAI, Antropic, Google, või kolmanda osapoole LLM API.
- Me ei treeni baasi mudelid oma transkriptid. Ainult opt-in peent tune kasutab parandusi sa selgesõnaliselt teha.
- Sünteetilised häälekloonid (TTS) on selgelt tähistatud AI- genereeritud failinimes, metaandmetes ja leheküljel.
Me kasutame mudeleid
| Näidis | Kasutatakse | Litsents | Käivitab |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transkriptsioon (vaikimisi) | MIT | Meie GPU |
| STT.ai Enhanced (custom fine-tune) | Transkriptsioon (palgakavad) | MIT (base) / Proprietary (fine-tune weights) | Meie GPU |
| Vosk | Reaalajas sõna voog | Apache 2.0 | Meie GPU |
| SpeechBrain ECAPA-TDNN | Kõneleja diarizeerimine | Apache 2.0 | Meie GPU |
| MadLAD-400 3B | Tõlkimine (450+ keelt) | Apache 2.0 | Meie GPU |
| Qwen2.5-1.5B (llama.cpp) | Kokkuvõte, analüüs, sisu genereerimine, RAG vestlus | Apache 2.0 | Meie GPU |
| F5-TTS | Hääle kloonimine / teksti kõneks | MIT | Meie GPU |
| all-MiniLM-L6-v2 | RAGi otsingute põimimine | Apache 2.0 | Meie GPU |
Me ei kutsu OpenAI, Antropic, Google Cloud või kolmanda osapoole LLM API iga funktsioon. Iga mudel eespool töötab riistvara meil on ja opereerida. Ainus väline AI teenus me kasutame on Translocapi.ai (ka Muddy Holdings) tõlkimiseks UI stringid ~ See kunagi puudutab oma transcribed sisu.
Kuidas me avalikustame tehisintellekti põlvkonna
- Transcript HTML- leheküljed: sisaldab < meta nime=\
- Teksti eksport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): lisada iga faili ülaosasse AI- genereeritud transkripti päiserida.
- Sünteetiline hääl / TTS väljund: WAV-failid sisaldavad metaandmetes silti "sünteetiline hääl" ja selget teadet allalaadimise lehel. Audible disclaimer on kaardil.
- API vastused: sisaldab _ai_kehtestatud: true väli igas JSON-vastuses, mis sisaldab transkribeeritud sisu.
Koolitusandmed
- Baasmodellid (Whisper, MadLAD, Qwen jne) on eelnevalt koolitatud vastavate kirjastajate poolt.
- Teie ärakirju EI kasutata baasmodellide treenimiseks.
- Kui parandad transkriptsiooni segmenti (pliiatsi ikoon) või märgid selle valesti (lipu ikoon) JA oled valinud sisse / privaatsuse seadistuste / (\)
- Eraldi võimaldab kaasaaitamine pluss audio kuni Hääl Lab toggle (ka at / Privaatsus seadistused /, ka vaikimisi off) kaasa aidata audio / segmentide sa õige, paaris parandatud tekst, kuni meie Hääl Lab andmekogu CC- BY- SA-4.0. Kaks lülitid on sõltumatu ~ võid anda kas nii või mitte.
- Üleslaaditud audio kustutatakse 24 tunni jooksul croni ‐ UNLESS- i abil, mille valisid\
Täpsus ja vead
AI transkriptsioon ei ole täiuslik. Sõnavead varieeruvad vastavalt kõneleja aktsendile, helikvaliteedile, keelele ja domeeni sõnavarale. Kriitiliseks kasutamiseks (juriidilised, meditsiinilised, reguleeritud tööstusharud) tuleb kontrollida võrreldes originaalheliga. Meie avalikud WERi võrdlusandmed mudeli kohta on: /models/.
Vastavusküsimused
ELi AI seaduse, GDPRi või muude nõuete täitmise küsimuste puhul: hello@stt.ai või kasutada kontaktvorm.
Viimati uuendatud: 2026-04-26.