KI-Politik und Transparenz
Welche KI wir verwenden, wo sie läuft, und wie wir die Offenlegungspflichten erfüllen (EU-AI-Gesetz Artikel 50, mit Wirkung 2026-08-02).
TL;DR
- Alle Transkripte sind KI-generiert. Jeder Ausgang trägt eine maschinenlesbare Offenlegung.
- Alle KI läuft auf unserer eigenen GPU. Wir senden Ihre Audio- oder Textdateien NICHT an OpenAI, Anthropoc, Google oder eine LLM API von Drittanbietern.
- Wir trainieren auf Ihren Transkripten NICHT Basismodelle. Nur ein Opt-in Feinabstimmung verwendet Korrekturen, die Sie explizit vornehmen.
- Synthetische Sprachklone (TTS) werden eindeutig als KI-generiert in Dateinamen, Metadaten und auf der Seite bezeichnet.
Wir verwenden Modelle
| Modell | Verwendet für | Lizenz | Laufen |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transkription (Standard) | MIT | Unsere GPU |
| STT.ai Enhanced (custom fine-tune) | Transkription (bezahlte Pläne) | MIT (base) / Proprietary (fine-tune weights) | Unsere GPU |
| Vosk | Echtzeit-Wortstreaming | Apache 2.0 | Unsere GPU |
| SpeechBrain ECAPA-TDNN | Veröffentlichungen | Apache 2.0 | Unsere GPU |
| MadLAD-400 3B | Übersetzung (450+ Sprachen) | Apache 2.0 | Unsere GPU |
| Qwen2.5-1.5B (llama.cpp) | Zusammenfassung, Analyse, Content Generierung, RAG-Chat | Apache 2.0 | Unsere GPU |
| F5-TTS | Sprachklonen / Text-zu-Sprach | MIT | Unsere GPU |
| all-MiniLM-L6-v2 | Einbettungen für die RAG-Suche | Apache 2.0 | Unsere GPU |
Wir rufen OpenAI, Anthropoc, Google Cloud oder eine LLM API von Drittanbietern nicht für jede Funktion auf. Jedes Modell läuft auf Hardware, die wir besitzen und betreiben. Der einzige externe AI-Dienst, den wir verwenden, ist translateapi.ai (auch Muddy Holdings) für die Übersetzung von UI-Strings – das berührt nie Ihre transkribierten Inhalte.
Wie wir die KI-Generation offenlegen
- HTML-Seiten übersetzen: <meta name=\ enthalten
- Textexporte (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): eine Kopfzeile mit 'AI-generated transcript' an der Spitze jeder Datei einschließen.
- Synthetische Stimme / TTS-Ausgabe: WAV-Dateien enthalten ein 'Synthetik-Stimme'-Tag in Metadaten und eine klare Mitteilung auf der Download-Seite. Audible Disclaimer ist auf der Roadmap.
- API-Antworten: enthalten ein _ai_generated: true field in jeder JSON-Antwort, die transkribierten Inhalt enthält.
Ausbildungsdaten
- Basismodelle (Whisper, MadLAD, Qwen, etc.) kommen von ihren jeweiligen Verlagen vortrainiert. Wir verwenden sie als Versand.
- Ihre Transkripte werden NICHT zum Trainieren von Basismodellen verwendet.
- Wenn Sie ein Transkriptsegment (das Bleistiftsymbol) korrigieren oder falsch markieren (das Flagsymbol), UND Sie haben sich bei /privacy-settings/ (\) entschieden.
- Separately, die Contribute Korrekturen plus Audio to Voice Lab Toggle (auch bei /privacy-settings/, auch default off) entscheidet Sie in den Beitrag der Audio von Segmenten, die Sie korrigieren, gepaart mit dem korrigierten Text, zu unserem Voice Lab Datensatz unter CC-BY-SA-4.0.
- Audio, das Sie hochladen, wird innerhalb von 24 Stunden über die cron cleanup_uploads gelöscht — UNLESS Sie in \ gewählt haben
Genauigkeit und Fehler
KI-Transkription ist nicht perfekt. Wortfehlerraten variieren durch Lautsprecherakzent, Audioqualität, Sprache und Domänenvokabular. Für kritische Verwendung (legale, medizinische, regulierte Branchen) überprüfen Sie mit dem ursprünglichen Audio. Unsere öffentlichen WER Benchmarks pro Modell sind bei /models/.
Einhaltungsfragen
Für EU-AI-Gesetz, DSGVO oder andere Compliance-Fragen: hello@stt.ai oder verwenden Sie die Kontaktformular.
Zuletzt aktualisiert: 2026-04-26.