KI-Politik und Transparenz

Welche KI wir verwenden, wo sie läuft, und wie wir die Offenlegungspflichten erfüllen (EU-AI-Gesetz Artikel 50, mit Wirkung 2026-08-02).

TL;DR

  • Alle Transkripte sind KI-generiert. Jeder Ausgang trägt eine maschinenlesbare Offenlegung.
  • Alle KI läuft auf unserer eigenen GPU. Wir senden Ihre Audio- oder Textdateien NICHT an OpenAI, Anthropoc, Google oder eine LLM API von Drittanbietern.
  • Wir trainieren kein Modell auf Ihren Transkripten. Jedes Modell, das wir betreiben, ist ein off-the-shelf Open-Source-Modell. Korrekturen, die Sie explizit machen, werden nur gesammelt, wenn Sie sich entscheiden.
  • Synthetische Sprachklone (TTS) werden eindeutig als KI-generiert in Dateinamen, Metadaten und auf der Seite bezeichnet.

Wir verwenden Modelle

ModellVerwendet fürLizenzLaufen
Whisper large-v3-turbo (faster-whisper)Transkription (Standard)MITUnsere GPU
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”Transkription (bezahlte Pläne)MITUnsere GPU
VoskEchtzeit-WortstreamingApache 2.0Unsere GPU
SpeechBrain ECAPA-TDNNVeröffentlichungenApache 2.0Unsere GPU
MadLAD-400 3BÜbersetzung (450+ Sprachen)Apache 2.0Unsere GPU
Qwen2.5-1.5B (llama.cpp)Zusammenfassung, Analyse, Content Generierung, RAG-ChatApache 2.0Unsere GPU
F5-TTSSprachklonen / Text-zu-SprachMITUnsere GPU
all-MiniLM-L6-v2Einbettungen für die RAG-SucheApache 2.0Unsere GPU

.STT.ai Enhanced, unser Produktname für Whisper large-v3 läuft auf unserer eigenen GPU. Es ist kein benutzerdefiniertes Modell, ein Feinabstimmung oder proprietäre Gewichte — es ist der größte und genaueste Whisper-Checkpoint. Es ist genauer als die Standard Whisper large-v3-Turbo, und etwa 1,5x langsamer auf einem diarized Job, gemessen auf unserer eigenen Hardware.

Wir rufen OpenAI, Anthropoc, Google Cloud oder eine LLM API von Drittanbietern nicht für jede Funktion auf. Jedes Modell läuft auf Hardware, die wir besitzen und betreiben. Der einzige externe AI-Dienst, den wir verwenden, ist translateapi.ai (auch Muddy Holdings) für die Übersetzung von UI-Strings – das berührt nie Ihre transkribierten Inhalte.

Wie wir die KI-Generation offenlegen

  • HTML-Seiten übersetzen: <meta name=\ enthalten
  • Textexporte (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): eine Kopfzeile mit 'AI-generated transcript' an der Spitze jeder Datei einschließen.
  • Synthetische Stimme / TTS-Ausgabe: WAV-Dateien enthalten ein 'Synthetik-Stimme'-Tag in Metadaten und eine klare Mitteilung auf der Download-Seite. Audible Disclaimer ist auf der Roadmap.
  • API-Antworten: enthalten ein _ai_generated: true field in jeder JSON-Antwort, die transkribierten Inhalt enthält.

Ausbildungsdaten

  • Basismodelle (Whisper, MadLAD, Qwen, etc.) kommen von ihren jeweiligen Verlagen vortrainiert. Wir verwenden sie als Versand.
  • Ihre Transkripte werden NICHT zum Trainieren von Basismodellen verwendet.
  • Wenn Sie ein Transkriptsegment (das Bleistiftsymbol) korrigieren oder es falsch markieren (das Flag-Symbol), UND Sie sich bei /privacy-settings/ ("Model Training"-Schalter, Standard-Ausschalten) entschieden haben, kann das (unkorrekte Text → korrigierte Text) Paar gesammelt werden, um ein zukünftiges Text-Korrekturmodell zu trainieren. Nur das Textpaar – nie das umgebende Audio – wird von diesem Pfad verwendet. Kein solches Modell existiert heute: Die Paare sind nur gespeichert, und nichts, das wir derzeit bedienen, wurde auf ihnen trainiert.
  • Separately, die Contribute Korrekturen plus Audio to Voice Lab Toggle (auch bei /privacy-settings/, auch default off) entscheidet Sie in den Beitrag der Audio von Segmenten, die Sie korrigieren, gepaart mit dem korrigierten Text, zu unserem Voice Lab Datensatz unter CC-BY-SA-4.0.
  • Audio, das Sie hochladen, wird innerhalb von 24 Stunden über die cron cleanup_uploads gelöscht — UNLESS Sie in \ gewählt haben

Genauigkeit und Fehler

KI-Transkription ist nicht perfekt. Wortfehlerraten variieren durch Lautsprecherakzent, Audioqualität, Sprache und Domänenvokabular. Für kritische Verwendung (legale, medizinische, regulierte Branchen) überprüfen Sie mit dem ursprünglichen Audio. Unsere öffentlichen WER Benchmarks pro Modell sind bei /models/.

Einhaltungsfragen

Für EU-AI-Gesetz, DSGVO oder andere Compliance-Fragen: hello@stt.ai oder verwenden Sie die Kontaktformular.

Zuletzt aktualisiert: 2026-08-05.