AI- regel og gjennomsikt

Kva for kunstig intelligens vi bruker, kvar den køyrer, og korleis vi oppfyller krav til offentleggjering (EU AI Act Article 50, gjeldande 2026-08-02).

TL;DR

  • Alle transkripsjonar er AI-genererte. Kvar utdata har ein maskinlesbar avsløring.
  • Vi sender IKKJE lyd eller tekst til OpenAI, Anthropic, Google eller nokon tredjeparts LLM API, men vi sender lyd og tekst til ein tredjepart som kan hjelpe oss med å utvikle LLM API.
  • Vi trenar IKKJE basemodeller på transkripsjonane dine. Berre ein opt-in-finjustering brukar rettingar du eksplisitt gjer.
  • Syntetiske stemmeklonar (TTS) er tydeleg merket som AI-generert i filnamn, metadata og på sida.

Modellar vi brukar

ModellBruka tilLisensKøyrer på
Whisper large-v3-turbo (faster-whisper)Transkripsjon (standard)MITGrafikkprosessoren vår
STT.ai Enhanced (custom fine-tune)Transkripsjon (betalt plan)MIT (base) / Proprietary (fine-tune weights)Grafikkprosessoren vår
VoskOrdstraum i sanntidApache 2.0Grafikkprosessoren vår
SpeechBrain ECAPA-TDNNHøgtalardialogApache 2.0Grafikkprosessoren vår
MadLAD-400 3BOmsetjing (450+ språk)Apache 2.0Grafikkprosessoren vår
Qwen2.5-1.5B (llama.cpp)Oppsummering, analyse, innhaldsgenerering, RAG-pratApache 2.0Grafikkprosessoren vår
F5-TTSTalekloning / tekst-til-taleMITGrafikkprosessoren vår
all-MiniLM-L6-v2Innebyggjarar for RAG- søkApache 2.0Grafikkprosessoren vår

Vi brukar ikkje OpenAI, Anthropic, Google Cloud eller andre tredjeparts LLM API for nokon funksjon. Alle modellane ovanfor køyrer på maskinvare vi eig og driv. Den einaste eksterne AI-tenesta vi brukar er translateapi.ai (også Muddy Holdings) for å omsetje UI-strengar – dette rører aldri det transkriberte innhaldet ditt.

Korleis vi gjev informasjon om AI-generering

  • HTML-sider: include <meta name=\
  • Teksteksport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): inkluder ei « AI-generert transkripsjon » - overskriftslinje øvst i kvar fil.
  • Syntetisk stemme / TTS- utdata: WAV-filer har ein «syntetisk stemme»-merkelapp i metadata og ein tydeleg merknad på nedlastingssida. Ein høyrbar ansvarsfraskriving er på vegkartet.
  • API-svar: inkluder eit _ai_generated: true-felt i kvart JSON-svar som inneheld transkribert innhald.

Treningsdata

  • Basismodellene (Whisper, MadLAD, Qwen, osv.) er førehandsopplærde frå dei respektive utgjevarane, og vi brukar dei som dei er.
  • Avskriftane dine vert IKKJE brukte til å trene opp basismodeller.
  • Dersom du korrigerer eit transkripsjonssegment (blyant- ikonet) eller markerer det som feil (flagg- ikonet), OG du har valt å gjere det i /privacy- settings/ (\
  • I tillegg kan du med funksjonen Bidra med rettingar og lyd til Talelaboratorium (også i /privacy-settings/, også av som standard) velje å bidra med lyd frå segmenta du korrigerer, saman med den korrigerte teksten, til Talelaboratorium-datasettet vårt under CC-BY-SA-4.0. Dei to funksjonane er uavhengige av kvarandre — du kan velje å tillate enten, begge, eller ingen av dei.
  • Lyd du lastar opp vert sletta innanfor 24 timar via cleanup_uploads cron — MED MINNE om at du har valt å \

Nøyaktigheit og feil

AI-transkripsjon er ikkje perfekt. Ordfeil varierer etter aksent, lydkvalitet, språk og ordforråd. For kritisk bruk (juridisk, medisinsk, regulerte bransjar) må du sjekke mot originallyden. Våre offentlege WER-målestokkar per modell er på /models/.

Spørsmål om samsvar

For EU AI Act, GDPR eller andre spørsmål om samsvar: hello@stt.ai eller bruk kontaktskjema.

Sist oppdatert: 2026-04-26.