Kunsmatige Beleid Deursigtigheid

Watter Kunsmatige inteligensie gebruik ons, waar dit loop, en hoe ons voldoen aan onthullingsvereistes (EU-KIwet Artikel 50, doeltreffende 2026- 08- 02).

TL;DR

  • Alle transkripsie word Kunsmatigel- printed. Elke afvoer het 'n masjienleesbare onthulling.
  • Alle KI loop op ons eie GPU. Ons stuur nie jou oudio- of teks na OpenAI, Anthropic, Google, of enige derde deel van LMM API nie.
  • Ons lei nie basis modelle op julle transkripsie nie, net 'n optooide in fyn-tune gebruik die regstellings wat jy uitdruklik maak.
  • Sintetiese stem klone (TTS) word duidelik gemerk as 'n kunsmatige hulpmiddel in 'n lêernaam, metadata en op die bladsy.

Modelle wat ons gebruik

ModelGebruik word virLisensieHardloop op
Whisper large-v3-turbo (faster-whisper)Oordrag (verstek)MITOns GPU
STT.ai Enhanced (custom fine-tune)Oordrag (betaalde planne)MIT (base) / Proprietary (fine-tune weights)Ons GPU
VoskReal-time woord stroomApache 2.0Ons GPU
SpeechBrain ECAPA-TDNNLuidspreker ontariseringApache 2.0Ons GPU
MadLAD-400 3BVertaling (C 450+ tale)Apache 2.0Ons GPU
Qwen2.5-1.5B (llama.cpp)Opsomming, ontleding, inhoud geslag, RAG-gesprekApache 2.0Ons GPU
F5-TTSStem kloning / teks- to-sechMITOns GPU
all-MiniLM-L6-v2Inlegbare vir RG soektogNameApache 2.0Ons GPU

Ons noem nie OpenAI, Antropic, Google Wolk of enige derde deel van LMM API vir enige kenmerk nie. Elke model hierbo loop op hardeware wat ons besit en bedryf. Die enigste eksterne kunsmatige KI-diens wat ons gebruik, is vertaalpi.ai (ook Muddy Hous) vir die vertaling van UI stringe ooit aan jou skryfinhoud.

Hoe ons 'n kunsmatige klomp mense bekend maak

  • Transscription: sluit <meta naam=\ in
  • Teks voer uit (TXT, SRT, VTTT, JSON, CSV, DOS, PDF): 'n'AI-geskrapte' opskrif lyn bo in elke lêer.
  • Sintetiese stem / TTS-afvoer: WAV-lêers sluit 'n'sintetiese-stem etiket in metadata en 'n duidelike kennisgewing op die aflaai bladsy in. Audible disclamer is op die padkaart.
  • API antwoord: bevat 'n _fout: ware veld in elke JSON - reaksie wat getransporteerde inhoud bevat.

Oefening data

  • Basis modelle (Whisper, MadLAD, Qwen, ens.) kom vooraf opgelei van hulle onderskeie verkondigers. Ons gebruik dit as-skip.
  • Jou transkripsie word nie gebruik om basismodelle op te lei nie.
  • As jy 'n transkripsie segment (die potlood ikoon) reg stel of dit verkeerd merk (die vlagikoon), en jy het gekies in /privacy-settings/ (\
  • Afsonderlik, die Bydrae regstellings plus klank na stem Lab wissel (ook by /privacy-settings/, asook verstek af) kies jy in om by te dra die oudio van dele wat jy reg het, paar met die gekorrige teks, na ons stem Lab datastel onder CC-BY-SA-4. 0. Die twee skakele is onafhanklike logist wat jy kan skenk beide, of nie.
  • Audio jy oplaai word uitgevee binne 24 uur via die skoonmaak_ laaie cron ënstein VN-LES jy verkies het na \

Akkuraatheid en foute

Kunsmatige transkripsie is nie volmaak nie. Woord foutkoerse verskil deur luidspreker aksent, klankgehalte, taal en domeinkeuse. Vir kritiese gebruik (wetaal, mediese, beheerde industrieë) bevestig teen die oorspronklike oudio. Ons openbare WER bankmerke per model is by /models/.

Nakomingsvrae

Vir EU-KI-wet, GDPR of ander nakomingsvrae: hello@stt.ai of gebruik die kontak vorm.

Laas opgedateer: 2026-04-26.