AI- praksis og gjennomsiktighet

Hva AI vi bruker, hvor det kjører, og hvordan vi oppfyller opplysningskravene (artikkel 50 i EUs AI-lov, effektiv 2026-08-02).

TL,DR

  • Alle utskrifter er laget av AI. Hver utdata inneholder en maskinleselig opplysning.
  • All AI kjører på vår egen GPU. Vi sender IKKE din lyd eller tekst til OpenAI, Antropic, Google eller noe tredjeparts LLM API.
  • Vi bruker IKKE togbaserte modeller på utskriftene dine.
  • Syntetiske stemmekloner (TTS) er tydelig merket som AI-genererte i filnavn, metadata og på siden.

Modeller vi bruker

ModellBrukt iLisensKjører på
Whisper large-v3-turbo (faster-whisper)Transskription (standard)MITVår GPU
STT.ai Enhanced (custom fine-tune)Transmisjonsordninger (betalte ordninger)MIT (base) / Proprietary (fine-tune weights)Vår GPU
VoskOrdstrømmer i sanntidApache 2.0Vår GPU
SpeechBrain ECAPA-TDNNHøytaler- ariseringApache 2.0Vår GPU
MadLAD-400 3BOversettelse (450+ språk) NameApache 2.0Vår GPU
Qwen2.5-1.5B (llama.cpp)Sammendrag, analyse, generering av innhold, RAG-pratApache 2.0Vår GPU
F5-TTSStemmekloning / tekst til taleMITVår GPU
all-MiniLM-L6-v2Inkludering for søk etter RAGApache 2.0Vår GPU

Vi kaller ikke OpenAI, Antropic, Google Cloud eller noen tredjeparts LLM API for noen funksjon. Hver modell over kjører på maskinvare vi eier og driver. Den eneste eksterne AI- tjenesten vi bruker er translatepi.ai (også Muddy Holdings) for å oversette brukergrensesnitt - dette berører aldri ditt transkriberte innhold.

Hvordan vi avslører AI-generering

  • Transskript HTML- sider: incl <meta name=\
  • Teksteksport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ta med en « AI- laget utskrift » - linje øverst i hver fil.
  • Syntetisk stemme / TTS- utdata: WAV- filer inneholder en « synonym- tale » - tagg i metadata og en tydelig merknad på nedlastingssiden. Audible disclaimer er på veikartet.
  • API-svar: inkludere et _ai_generert: sann felt i hvert JSON-svar som inneholder transkribert innhold.

Opplæringsdata

  • Basismodeller (Whisper, MadLAD, Qwen, osv.) kommer i forkant av sine respektive utgivere.
  • Dine utskrifter brukes IKKE til togbasemodeller.
  • Hvis du korrigerer et utskriftssegment (symbolet for blyant) eller merker det som feil (flaggikonet), OG du har valgt inn på / privacy- settings / (\
  • Atskilt velger « Bidra til » - rettelser pluss lyd til « Voice Lab » - bryteren (også ved / privacy- sett /, også standard av) deg i å bidra med lyden fra segmenter du retter, sammenstilt med den korrigerte teksten, til vårt tallsett for Voice Lab under CC- BY- SA-4. 0. De to avkrysserne er uavhengige – du kan gi enten, begge eller ingen av delene.
  • Lyden du laster opp slettes innen 24 timer via cron i oppryddingssløring. – UNLESS du har valgt til \

Nøyaktighet og feil

AI- utskrift er ikke perfekt. Ordfeilratene varierer etter høyttaleraksent, lydkvalitet, språk og domene- glosesamling. For kritisk bruk (lovlig, medisinsk, regulert industri) verifiser mot den opprinnelige lyden. Våre offentlige WER- referanseverdier for hver modell er på /models/.

Samsvarsspørsmål

For EUs AI-lov, GDPR eller andre samsvarsspørsmål: hello@stt.ai eller bruk kontaktskjema.

Sist oppdatert: 2026-04-26.