Politik & Transparenz
Et ass eng vun de gréisste Gemengen an der Belsch, an huet ronn 20.000 Awunner (Stand 2016).
TL;DR
- All Transkriptioune sinn AI- generéiert. All Ausgab huet eng Maschinn- liesbar Offenbarung.
- All AI leeft op eiser eegene GPU. Mir schécken Äert Audio oder Text NI un OpenAI, Anthropic, Google oder eng aner LLM API.
- Mir trainéieren net Basismodeller op Ären Transkriptiounen. Just eng opt-in Fine-Tuning benotzt Korrekturen déi Dir explizit maacht.
- D'Synthese vun der Stëmm (Synthesized Voice) gëtt als AI-generéiert an de Datei-, Metadaten- an op der Säite-Namen markéiert.
Modelle déi mir benotze
| Modell | Verwendet fir | Lizenz | Läuft op |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transkriptioun (Standard) | MIT | D'GPU |
| STT.ai Enhanced (custom fine-tune) | Transkriptioun (bezuelte Pläng) | MIT (base) / Proprietary (fine-tune weights) | D'GPU |
| Vosk | Echtzäit-Wordstreaming | Apache 2.0 | D'GPU |
| SpeechBrain ECAPA-TDNN | Lëscht vun de Dichter | Apache 2.0 | D'GPU |
| MadLAD-400 3B | Iwwersetzung (450+ Sproochen) | Apache 2.0 | D'GPU |
| Qwen2.5-1.5B (llama.cpp) | Analys, Analysen, Analysen | Apache 2.0 | D'GPU |
| F5-TTS | Sprooche-Klonen / Text-zu-Sprooch | MIT | D'GPU |
| all-MiniLM-L6-v2 | Lëscht vun de lëtzebuergesche Gemengen | Apache 2.0 | D'GPU |
D'Lëtzebuerger Sprooch ass eng vun de gréisste Sproochen op der Welt, mat enger ongeféier 1,5 Millioune Sproochepräsenz. D'Lëtzebuerger Sprooch ass eng vun de gréisste Sproochen op der Welt, mat enger ongeféier 1,5 Millioune Sproochepräsenz.
D'Generatioun vun der Geschicht
- Websäit vun der Gemeng: include <meta name=\
- Textexporter (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): eng 'AI-generéiert Transkript' Kopfzeil um Ufank vun all Datei abezéien.
- Synthetesch Sprooch / TTS-Ausgab: WAV Dateien enthalen en'synthetesch Stëmm' Tag an Metadaten an eng kloer Noriicht op der Download Säit. Audible Disclaimer ass op der Roadmap.
- API-Antworten: include an _ai_generated: true field in every JSON response that contains transcribed content.
Trainingsdaten
- Basismodeller (Whisper, MadLAD, Qwen, etc.) kommen vun hiren respektiven Editeuren virgetrainéiert. Mir benotzen se wéi se verschéckt ginn.
- D'Resultat ass eng Basis fir d'Entwécklung vun neie Modeller.
- Wann Dir e Transkriptiounssegment korrigéiert (de Bleistift-Ikon) oder et als falsch markéiert (de Flagge-Ikon), an Dir hutt op / privacy-settings / (\
- D'Optioun Korrekturen an Audio un de Voice Lab iwwerdroen (och ënner /privacy-settings/, standardméisseg aus) erlaabt Iech, den Audio vun de Segmenten, déi Dir korrigéiert hutt, zesumme mam korrigéierte Text un eise Voice Lab-Datesatz ënner CC-BY-SA-4.0 ze iwwerdroen. D'Zwee Optiounen sinn onofhängeg - Dir kënnt entweder eng, béid oder keng vun deenen zouloossen.
- Audiodateien déi Dir eropgeluede hutt, ginn an 24 Stonnen iwwer den cleanup_uploads cron geléist — ONGEFIR Dir \
Präzisioun a Feeler
AI Transkriptioun ass net perfekt. Wierder Feelerraten variéieren no Sprecher Akzent, Audio Qualitéit, Sprooch, an Domain Vokabulaire. Fir kritesch Benotzung (juristesch, medizinesch, reglementéiert Industrien) kontrolléiert géint den originelle Audio. Eis ëffentlech WER Benchmarks pro Modell sinn op /models/.
Compliance Froen
D'EU-Kommissioun huet d'EU-Recht, d'EU-Rechtsnormen an d'EU-Rechtsnormen an der EU-Verfassung festgehale. hello@stt.ai oder benotzt d' Kontaktformular.
Letzt aktualiséiert: 2026-04-26.