AI- regel og gjennomsikt
Kva for kunstig intelligens vi bruker, kvar den køyrer, og korleis vi oppfyller krav til offentleggjering (EU AI Act Article 50, gjeldande 2026-08-02).
TL;DR
- Alle transkripsjonar er AI-genererte. Kvar utdata har ein maskinlesbar avsløring.
- Vi sender IKKJE lyd eller tekst til OpenAI, Anthropic, Google eller nokon tredjeparts LLM API, men vi sender lyd og tekst til ein tredjepart som kan hjelpe oss med å utvikle LLM API.
- Vi trenar IKKJE basemodeller på transkripsjonane dine. Berre ein opt-in-finjustering brukar rettingar du eksplisitt gjer.
- Syntetiske stemmeklonar (TTS) er tydeleg merket som AI-generert i filnamn, metadata og på sida.
Modellar vi brukar
| Modell | Bruka til | Lisens | Køyrer på |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transkripsjon (standard) | MIT | Grafikkprosessoren vår |
| STT.ai Enhanced (custom fine-tune) | Transkripsjon (betalt plan) | MIT (base) / Proprietary (fine-tune weights) | Grafikkprosessoren vår |
| Vosk | Ordstraum i sanntid | Apache 2.0 | Grafikkprosessoren vår |
| SpeechBrain ECAPA-TDNN | Høgtalardialog | Apache 2.0 | Grafikkprosessoren vår |
| MadLAD-400 3B | Omsetjing (450+ språk) | Apache 2.0 | Grafikkprosessoren vår |
| Qwen2.5-1.5B (llama.cpp) | Oppsummering, analyse, innhaldsgenerering, RAG-prat | Apache 2.0 | Grafikkprosessoren vår |
| F5-TTS | Talekloning / tekst-til-tale | MIT | Grafikkprosessoren vår |
| all-MiniLM-L6-v2 | Innebyggjarar for RAG- søk | Apache 2.0 | Grafikkprosessoren vår |
Vi brukar ikkje OpenAI, Anthropic, Google Cloud eller andre tredjeparts LLM API for nokon funksjon. Alle modellane ovanfor køyrer på maskinvare vi eig og driv. Den einaste eksterne AI-tenesta vi brukar er translateapi.ai (også Muddy Holdings) for å omsetje UI-strengar – dette rører aldri det transkriberte innhaldet ditt.
Korleis vi gjev informasjon om AI-generering
- HTML-sider: include <meta name=\
- Teksteksport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): inkluder ei « AI-generert transkripsjon » - overskriftslinje øvst i kvar fil.
- Syntetisk stemme / TTS- utdata: WAV-filer har ein «syntetisk stemme»-merkelapp i metadata og ein tydeleg merknad på nedlastingssida. Ein høyrbar ansvarsfraskriving er på vegkartet.
- API-svar: inkluder eit _ai_generated: true-felt i kvart JSON-svar som inneheld transkribert innhald.
Treningsdata
- Basismodellene (Whisper, MadLAD, Qwen, osv.) er førehandsopplærde frå dei respektive utgjevarane, og vi brukar dei som dei er.
- Avskriftane dine vert IKKJE brukte til å trene opp basismodeller.
- Dersom du korrigerer eit transkripsjonssegment (blyant- ikonet) eller markerer det som feil (flagg- ikonet), OG du har valt å gjere det i /privacy- settings/ (\
- I tillegg kan du med funksjonen Bidra med rettingar og lyd til Talelaboratorium (også i /privacy-settings/, også av som standard) velje å bidra med lyd frå segmenta du korrigerer, saman med den korrigerte teksten, til Talelaboratorium-datasettet vårt under CC-BY-SA-4.0. Dei to funksjonane er uavhengige av kvarandre — du kan velje å tillate enten, begge, eller ingen av dei.
- Lyd du lastar opp vert sletta innanfor 24 timar via cleanup_uploads cron — MED MINNE om at du har valt å \
Nøyaktigheit og feil
AI-transkripsjon er ikkje perfekt. Ordfeil varierer etter aksent, lydkvalitet, språk og ordforråd. For kritisk bruk (juridisk, medisinsk, regulerte bransjar) må du sjekke mot originallyden. Våre offentlege WER-målestokkar per modell er på /models/.
Spørsmål om samsvar
For EU AI Act, GDPR eller andre spørsmål om samsvar: hello@stt.ai eller bruk kontaktskjema.
Sist oppdatert: 2026-04-26.