AI-politik och öppenhet

Vad AI vi använder, var det körs, och hur vi uppfyller kraven på offentliggörande (EU AI Act Article 50, träder i kraft 2026-08-02).

TL;DR

  • Alla utskrifter är AI-genererade.
  • All AI körs på vår egen GPU. Vi skickar INTE ditt ljud eller text till OpenAI, Anthropic, Google, eller någon tredje part LLM API.
  • Vi tränar INTE basmodeller på dina utskrifter. Endast en opt-in fine-tune använder korrigeringar du uttryckligen gör.
  • Syntetiska röstkloner (TTS) är tydligt märkta som AI-genererad i filnamn, metadata, och på sidan.

Modeller vi använder

FörlagaAnvänds förLicensKörs på
Whisper large-v3-turbo (faster-whisper)Omvandling (standard)MITVår GPU
STT.ai Enhanced (custom fine-tune)Transkription (betald plan)MIT (base) / Proprietary (fine-tune weights)Vår GPU
Voskstreaming av ord i realtidApache 2.0Vår GPU
SpeechBrain ECAPA-TDNNHögtalardiariseringApache 2.0Vår GPU
MadLAD-400 3BÖversättning (450+ språk)Apache 2.0Vår GPU
Qwen2.5-1.5B (llama.cpp)Sammanfattning, analys, innehållsgenerering, RAG chattApache 2.0Vår GPU
F5-TTSRöstkloning/text-till-talMITVår GPU
all-MiniLM-L6-v2Inbäddningar för sökning i RAGApache 2.0Vår GPU

Vi kallar inte OpenAI, Anthropic, Google Cloud, eller någon tredje part LLM API för någon funktion. Varje modell ovan körs på hårdvara som vi äger och arbetar. Den enda externa AI-tjänst vi använder är translateapi.ai (även Muddy Holdings) för att översätta UI strängar - detta aldrig berör ditt transkriberade innehåll.

Hur vi avslöjar AI generation

  • Transskription av HTML- sidor: innehåller <meta namn=\
  • Textexport (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): innehålla en rubrikrad med 'AI-genererad utskrift' högst upp i varje fil.
  • Syntetisk röst/TTS-utgång: WAV-filer innehåller en "syntetisk-röst"-tagg i metadata och ett tydligt meddelande på nedladdningssidan. Audible disclaimer finns på färdplanen.
  • API-svar: inkludera ett _ai_genererat: sant fält i varje JSON-svar som innehåller transkriberat innehåll.

Utbildningsuppgifter

  • Basmodeller (Whisper, MadLAD, Qwen, etc.) kommer förtränade från sina respektive förlag. Vi använder dem som skeppas.
  • Dina utskrifter används INTE för att träna basmodeller.
  • Om du korrigerar ett utskriftssegment (pennaikonen) eller markerar det felaktigt (flaggikonen), OCH du har valt att göra / privacy-inställningar / (\
  • Separat väljer Bidra korrigeringar plus ljud till Voice Lab att växla (även på /privacy-inställningar /, även standard av) väljer du att bidra ljudet av segment du korrigerar, parat med den korrigerade texten, till vår Voice Lab dataset under CC-BY-SA-4.0. De två Växlarna är oberoende - du kan bevilja antingen, både, eller ingendera.
  • Ljud du laddar upp raderas inom 24 timmar via cleanup_uploads cron — ONLESS du har valt att \

Noggrannhet och fel

AI transkription är inte perfekt. Word felfrekvenser varierar efter högtalare accent, ljudkvalitet, språk och domän vokabulär. För kritisk användning (legal, medicinsk, reglerad industri) verifiera mot den ursprungliga ljud. Vår offentliga WER riktmärken per modell är på /models/.

Frågor om efterlevnad

För EU AI-lagen, GDPR eller andra efterlevnadsfrågor: hello@stt.ai eller använd kontaktformulär.

Senast uppdaterad: 2026-04-26.