Kunsmatige Beleid Deursigtigheid
Watter Kunsmatige inteligensie gebruik ons, waar dit loop, en hoe ons voldoen aan onthullingsvereistes (EU-KIwet Artikel 50, doeltreffende 2026- 08- 02).
TL;DR
- Alle transkripsie word Kunsmatigel- printed. Elke afvoer het 'n masjienleesbare onthulling.
- Alle KI loop op ons eie GPU. Ons stuur nie jou oudio- of teks na OpenAI, Anthropic, Google, of enige derde deel van LMM API nie.
- Ons lei nie basis modelle op julle transkripsie nie, net 'n optooide in fyn-tune gebruik die regstellings wat jy uitdruklik maak.
- Sintetiese stem klone (TTS) word duidelik gemerk as 'n kunsmatige hulpmiddel in 'n lêernaam, metadata en op die bladsy.
Modelle wat ons gebruik
| Model | Gebruik word vir | Lisensie | Hardloop op |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Oordrag (verstek) | MIT | Ons GPU |
| STT.ai Enhanced (custom fine-tune) | Oordrag (betaalde planne) | MIT (base) / Proprietary (fine-tune weights) | Ons GPU |
| Vosk | Real-time woord stroom | Apache 2.0 | Ons GPU |
| SpeechBrain ECAPA-TDNN | Luidspreker ontarisering | Apache 2.0 | Ons GPU |
| MadLAD-400 3B | Vertaling (C 450+ tale) | Apache 2.0 | Ons GPU |
| Qwen2.5-1.5B (llama.cpp) | Opsomming, ontleding, inhoud geslag, RAG-gesprek | Apache 2.0 | Ons GPU |
| F5-TTS | Stem kloning / teks- to-sech | MIT | Ons GPU |
| all-MiniLM-L6-v2 | Inlegbare vir RG soektogName | Apache 2.0 | Ons GPU |
Ons noem nie OpenAI, Antropic, Google Wolk of enige derde deel van LMM API vir enige kenmerk nie. Elke model hierbo loop op hardeware wat ons besit en bedryf. Die enigste eksterne kunsmatige KI-diens wat ons gebruik, is vertaalpi.ai (ook Muddy Hous) vir die vertaling van UI stringe ooit aan jou skryfinhoud.
Hoe ons 'n kunsmatige klomp mense bekend maak
- Transscription: sluit <meta naam=\ in
- Teks voer uit (TXT, SRT, VTTT, JSON, CSV, DOS, PDF): 'n'AI-geskrapte' opskrif lyn bo in elke lêer.
- Sintetiese stem / TTS-afvoer: WAV-lêers sluit 'n'sintetiese-stem etiket in metadata en 'n duidelike kennisgewing op die aflaai bladsy in. Audible disclamer is op die padkaart.
- API antwoord: bevat 'n _fout: ware veld in elke JSON - reaksie wat getransporteerde inhoud bevat.
Oefening data
- Basis modelle (Whisper, MadLAD, Qwen, ens.) kom vooraf opgelei van hulle onderskeie verkondigers. Ons gebruik dit as-skip.
- Jou transkripsie word nie gebruik om basismodelle op te lei nie.
- As jy 'n transkripsie segment (die potlood ikoon) reg stel of dit verkeerd merk (die vlagikoon), en jy het gekies in /privacy-settings/ (\
- Afsonderlik, die Bydrae regstellings plus klank na stem Lab wissel (ook by /privacy-settings/, asook verstek af) kies jy in om by te dra die oudio van dele wat jy reg het, paar met die gekorrige teks, na ons stem Lab datastel onder CC-BY-SA-4. 0. Die twee skakele is onafhanklike logist wat jy kan skenk beide, of nie.
- Audio jy oplaai word uitgevee binne 24 uur via die skoonmaak_ laaie cron ënstein VN-LES jy verkies het na \
Akkuraatheid en foute
Kunsmatige transkripsie is nie volmaak nie. Woord foutkoerse verskil deur luidspreker aksent, klankgehalte, taal en domeinkeuse. Vir kritiese gebruik (wetaal, mediese, beheerde industrieë) bevestig teen die oorspronklike oudio. Ons openbare WER bankmerke per model is by /models/.
Nakomingsvrae
Vir EU-KI-wet, GDPR of ander nakomingsvrae: hello@stt.ai of gebruik die kontak vorm.
Laas opgedateer: 2026-04-26.