AI- praksis og gjennomsiktighet
Hva AI vi bruker, hvor det kjører, og hvordan vi oppfyller opplysningskravene (artikkel 50 i EUs AI-lov, effektiv 2026-08-02).
TL,DR
- Alle utskrifter er laget av AI. Hver utdata inneholder en maskinleselig opplysning.
- All AI kjører på vår egen GPU. Vi sender IKKE din lyd eller tekst til OpenAI, Antropic, Google eller noe tredjeparts LLM API.
- Vi bruker IKKE togbaserte modeller på utskriftene dine.
- Syntetiske stemmekloner (TTS) er tydelig merket som AI-genererte i filnavn, metadata og på siden.
Modeller vi bruker
| Modell | Brukt i | Lisens | Kjører på |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transskription (standard) | MIT | Vår GPU |
| STT.ai Enhanced (custom fine-tune) | Transmisjonsordninger (betalte ordninger) | MIT (base) / Proprietary (fine-tune weights) | Vår GPU |
| Vosk | Ordstrømmer i sanntid | Apache 2.0 | Vår GPU |
| SpeechBrain ECAPA-TDNN | Høytaler- arisering | Apache 2.0 | Vår GPU |
| MadLAD-400 3B | Oversettelse (450+ språk) Name | Apache 2.0 | Vår GPU |
| Qwen2.5-1.5B (llama.cpp) | Sammendrag, analyse, generering av innhold, RAG-prat | Apache 2.0 | Vår GPU |
| F5-TTS | Stemmekloning / tekst til tale | MIT | Vår GPU |
| all-MiniLM-L6-v2 | Inkludering for søk etter RAG | Apache 2.0 | Vår GPU |
Vi kaller ikke OpenAI, Antropic, Google Cloud eller noen tredjeparts LLM API for noen funksjon. Hver modell over kjører på maskinvare vi eier og driver. Den eneste eksterne AI- tjenesten vi bruker er translatepi.ai (også Muddy Holdings) for å oversette brukergrensesnitt - dette berører aldri ditt transkriberte innhold.
Hvordan vi avslører AI-generering
- Transskript HTML- sider: incl <meta name=\
- Teksteksport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ta med en « AI- laget utskrift » - linje øverst i hver fil.
- Syntetisk stemme / TTS- utdata: WAV- filer inneholder en « synonym- tale » - tagg i metadata og en tydelig merknad på nedlastingssiden. Audible disclaimer er på veikartet.
- API-svar: inkludere et _ai_generert: sann felt i hvert JSON-svar som inneholder transkribert innhold.
Opplæringsdata
- Basismodeller (Whisper, MadLAD, Qwen, osv.) kommer i forkant av sine respektive utgivere.
- Dine utskrifter brukes IKKE til togbasemodeller.
- Hvis du korrigerer et utskriftssegment (symbolet for blyant) eller merker det som feil (flaggikonet), OG du har valgt inn på / privacy- settings / (\
- Atskilt velger « Bidra til » - rettelser pluss lyd til « Voice Lab » - bryteren (også ved / privacy- sett /, også standard av) deg i å bidra med lyden fra segmenter du retter, sammenstilt med den korrigerte teksten, til vårt tallsett for Voice Lab under CC- BY- SA-4. 0. De to avkrysserne er uavhengige – du kan gi enten, begge eller ingen av delene.
- Lyden du laster opp slettes innen 24 timer via cron i oppryddingssløring. – UNLESS du har valgt til \
Nøyaktighet og feil
AI- utskrift er ikke perfekt. Ordfeilratene varierer etter høyttaleraksent, lydkvalitet, språk og domene- glosesamling. For kritisk bruk (lovlig, medisinsk, regulert industri) verifiser mot den opprinnelige lyden. Våre offentlige WER- referanseverdier for hver modell er på /models/.
Samsvarsspørsmål
For EUs AI-lov, GDPR eller andre samsvarsspørsmål: hello@stt.ai eller bruk kontaktskjema.
Sist oppdatert: 2026-04-26.