AI-politik och öppenhet
Vad AI vi använder, var det körs, och hur vi uppfyller kraven på offentliggörande (EU AI Act Article 50, träder i kraft 2026-08-02).
TL;DR
- Alla utskrifter är AI-genererade.
- All AI körs på vår egen GPU. Vi skickar INTE ditt ljud eller text till OpenAI, Anthropic, Google, eller någon tredje part LLM API.
- Vi tränar INTE basmodeller på dina utskrifter. Endast en opt-in fine-tune använder korrigeringar du uttryckligen gör.
- Syntetiska röstkloner (TTS) är tydligt märkta som AI-genererad i filnamn, metadata, och på sidan.
Modeller vi använder
| Förlaga | Används för | Licens | Körs på |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Omvandling (standard) | MIT | Vår GPU |
| STT.ai Enhanced (custom fine-tune) | Transkription (betald plan) | MIT (base) / Proprietary (fine-tune weights) | Vår GPU |
| Vosk | streaming av ord i realtid | Apache 2.0 | Vår GPU |
| SpeechBrain ECAPA-TDNN | Högtalardiarisering | Apache 2.0 | Vår GPU |
| MadLAD-400 3B | Översättning (450+ språk) | Apache 2.0 | Vår GPU |
| Qwen2.5-1.5B (llama.cpp) | Sammanfattning, analys, innehållsgenerering, RAG chatt | Apache 2.0 | Vår GPU |
| F5-TTS | Röstkloning/text-till-tal | MIT | Vår GPU |
| all-MiniLM-L6-v2 | Inbäddningar för sökning i RAG | Apache 2.0 | Vår GPU |
Vi kallar inte OpenAI, Anthropic, Google Cloud, eller någon tredje part LLM API för någon funktion. Varje modell ovan körs på hårdvara som vi äger och arbetar. Den enda externa AI-tjänst vi använder är translateapi.ai (även Muddy Holdings) för att översätta UI strängar - detta aldrig berör ditt transkriberade innehåll.
Hur vi avslöjar AI generation
- Transskription av HTML- sidor: innehåller <meta namn=\
- Textexport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): innehålla en rubrikrad med 'AI-genererad utskrift' högst upp i varje fil.
- Syntetisk röst/TTS-utgång: WAV-filer innehåller en "syntetisk-röst"-tagg i metadata och ett tydligt meddelande på nedladdningssidan. Audible disclaimer finns på färdplanen.
- API-svar: inkludera ett _ai_genererat: sant fält i varje JSON-svar som innehåller transkriberat innehåll.
Utbildningsuppgifter
- Basmodeller (Whisper, MadLAD, Qwen, etc.) kommer förtränade från sina respektive förlag. Vi använder dem som skeppas.
- Dina utskrifter används INTE för att träna basmodeller.
- Om du korrigerar ett utskriftssegment (pennaikonen) eller markerar det felaktigt (flaggikonen), OCH du har valt att göra / privacy-inställningar / (\
- Separat väljer Bidra korrigeringar plus ljud till Voice Lab att växla (även på /privacy-inställningar /, även standard av) väljer du att bidra ljudet av segment du korrigerar, parat med den korrigerade texten, till vår Voice Lab dataset under CC-BY-SA-4.0. De två Växlarna är oberoende - du kan bevilja antingen, både, eller ingendera.
- Ljud du laddar upp raderas inom 24 timmar via cleanup_uploads cron — ONLESS du har valt att \
Noggrannhet och fel
AI transkription är inte perfekt. Word felfrekvenser varierar efter högtalare accent, ljudkvalitet, språk och domän vokabulär. För kritisk användning (legal, medicinsk, reglerad industri) verifiera mot den ursprungliga ljud. Vår offentliga WER riktmärken per modell är på /models/.
Frågor om efterlevnad
För EU AI-lagen, GDPR eller andra efterlevnadsfrågor: hello@stt.ai eller använd kontaktformulär.
Senast uppdaterad: 2026-04-26.