Politica e trasparenza dell' IA

Che cosa AI usiamo, dove funziona, e come rispettiamo gli obblighi di divulgazione (EU AI Act Article 50, effective 2026-08-02).

TL;DR

  • Tutte le trascrizioni sono generate da IA. Ogni uscita porta una rivelazione leggibile da una macchina.
  • Tutte le AI vengono eseguite sulla nostra GPU. NON inviamo il tuo audio o testo a OpenAI, Anthropic, Google o a qualsiasi API LLM di terze parti.
  • Non alleniamo nessun modello sulle trascrizioni. Ogni modello che eseguiamo è un modello open-source fuori dal campo. Le correzioni che fai esplicitamente vengono raccolte solo se scegli di farlo.
  • I cloni vocali sintetici (TTS) sono chiaramente etichettati come AI-generati in nome file, metadati, e sulla pagina.

Modelli che usiamo

ModelloUsato perLicenzaCorre su
Whisper large-v3-turbo (faster-whisper)Trascrizione (default)MITLa nostra GPU
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”Trascrizione (piani a pagamento)MITLa nostra GPU
VoskIn tempo realeApache 2.0La nostra GPU
SpeechBrain ECAPA-TDNNDiarizzazione dei diffusoriApache 2.0La nostra GPU
MadLAD-400 3BTraduzione (450+ lingue)Apache 2.0La nostra GPU
Qwen2.5-1.5B (llama.cpp)Sintesi, analisi, generazione di contenuti, chat RAGApache 2.0La nostra GPU
F5-TTSClonazione vocale / testo a voceMITLa nostra GPU
all-MiniLM-L6-v2Inserzioni per la ricerca RAGApache 2.0La nostra GPU

“STT.ai Enhanced” is our product name for Whisper large-v3 running on our own GPU. It is not a custom model, a fine-tune, or proprietary weights — it is the largest and most accurate Whisper checkpoint. It is more accurate than the default Whisper large-v3-turbo, and about 1.5x slower on a diarized job, measured on our own hardware.

Non chiamiamo OpenAI, Anthropic, Google Cloud o qualsiasi API LLM di terze parti per qualsiasi funzionalità. Ogni modello sopra eseguito su hardware che possediamo e operiamo. L'unico servizio esterno AI che utilizziamo è translateapi.ai (anche Muddy Holdings) per tradurre stringhe UI.

Come divulghiamo la generazione di AI

  • Pagine HTML dei trascrizioni: include <meta name=\
  • Esportazione di testi (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): include una riga di intestazione 'AI-generata' nella parte superiore di ogni file.
  • Voce sintetica / Uscita TTS: I file WAV includono un tag'sintetico-voce' nei metadati e una chiara comunicazione sulla pagina di download. Disclaimer acustico è sulla roadmap.
  • Risposte API: includere un _ai_generato: vero campo in ogni risposta JSON che contiene contenuti trascritti.

Dati relativi alla formazione

  • I modelli base (Whisper, MadLAD, Qwen, ecc.) vengono pre-allenati dai rispettivi editori.
  • Le trascrizioni NON sono utilizzate per addestrare i modelli base.
  • Se si corregge un segmento di trascrizione (l'icona della matita) o lo si contrassegna in modo errato (l'icona della bandiera), e si è optato per /privacy-settings/ ("Modello Training" disattivare, default), la coppia (testo non corretto → testo corretto) può essere raccolta per formare un futuro modello di correzione del testo. Solo la coppia di testo και non viene mai utilizzata da questo percorso. Non esiste oggi tale modello: le coppie sono memorizzate solo e nulla di ciò che serviamo attualmente è stato addestrato su di esse.
  • Separatamente, le correzioni Contribuisci più audio a Voice Lab toggle (anche a /privacy-settings/, anche di default off) ti opta per contribuire all'audio dei segmenti corretti, abbinati al testo corretto, al nostro set di dati Voice Lab sotto CC-BY-SA-4. I due toggle sono indipendenti.
  • Audio caricato viene eliminato entro 24 ore tramite il cleanup_uploads cron Hoppenstedt UNLESS avete scelto di \

Precisione ed errori

La trascrizione AI non è perfetta. I tassi di errore delle parole variano in base all'accento degli altoparlanti, alla qualità audio, alla lingua e al vocabolario di dominio. Per uso critico (industria legale, medicale, regolamentata) verificare l'audio originale. I nostri benchmark WER pubblici per modello sono a /models/.

Domande di conformità

Per EU AI Act, GDPR o altre domande di conformità: hello@stt.ai o utilizzare il modulo di contatto.

Ultimo aggiornamento: 2026-08-05.