Política i transparència de l'AI

El que fem servir per on funciona, i com compleixem amb els requeriments de revelació (EUAI Acto Institut 50, efectiu 2026-08-02).

TL;DR

  • Totes les transcripcions són AI- Lesson· les. Cada sortida porta una revelació llegible.
  • Tota IA funciona per la nostra pròpia GPU. NO us enviarem el vostre so o text a OpenAI, Anthropic, Google, o qualsevol API de tercers parts.
  • NO formem cap model en les seves transcripcions. Cada model que executeu és un model de lliure font obert de l' esclau. Les correccions que feu explícitament només es recullen si opteu.
  • Els clons de veu sintetitzats (TTS) s' anomenen clarament com a "A" generats al nom de fitxer, metadades i a la pàgina.

Models que utilitzem

ModelUsat perLlicènciaExecuta en
Whisper large-v3-turbo (faster-whisper)Transcripció (per omissió)MITLa nostra GPU
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”Transcripció (plans pagables)MITLa nostra GPU
VoskS' està executant el flux de paraules en temps realApache 2.0La nostra GPU
SpeechBrain ECAPA-TDNNDiarització del presidentApache 2.0La nostra GPU
MadLAD-400 3BTraducció (450+ llengües)Apache 2.0La nostra GPU
Qwen2.5-1.5B (llama.cpp)Resum, anàlisi, generació de continguts, xat ARGApache 2.0La nostra GPU
F5-TTSReferent de veu / text a veuMITLa nostra GPU
all-MiniLM-L6-v2Encastades per a cerques ARGApache 2.0La nostra GPU

“STT.ai Enhanced” is our product name for Whisper large-v3 running on our own GPU. It is not a custom model, a fine-tune, or proprietary weights — it is the largest and most accurate Whisper checkpoint. It is more accurate than the default Whisper large-v3-turbo, and about 1.5x slower on a diarized job, measured on our own hardware.

No anomenem l'OpenAI, Anthropic, Google Cloud, o qualsevol API de tercers LLLM per a qualsevol funcionalitat. Cada model més amunt s' executa en el maquinari que nosaltres tenim i opera. L' únic servei extern de l' IA que utilitzem és tradueix.ai (també Holdings) per traduir cadenes IUGOGOGN que no toca el contingut transcrivicat.

Com revelem la generació de l'AI

  • Pàgines HTML del Transcript: include < meta nom=\
  • Exportacions de text (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Inclou una línia de capçalera 'I- Òplipada' a dalt de cada fitxer.
  • Sortida sintetitzada / TTS: Els fitxers WAV inclouen una etiqueta "syntètica " en les metadades i una clara nota a la pàgina de descàrrega. A audible disclaimer està al mapa de carreteres.
  • Respostes API: Inclou un camp _ai_ Lesson: un valor real en cada resposta JSON que conté contingut transcripït.

Dades d' entrenament

  • Models base (Whisper, MadLAD, Qwen, etc.) arriben pre-experts dels seus respectius editors.
  • Les vostres transcripcions NO s' usen per entrenar models base.
  • Si teniu raó un segment de transcripció (la icona del llapis) o marqueu- lo incorrecte (la icona de bandera), i heu optat a / phracy- control/ ("Model Entrenament" commutat, per omissió), la parella (en text corregit) es pot recollir per a entrenar un model de text futura. Només la parella de text no està mai seleccionada per aquesta ruta. No existeix cap model d' aquest model avui: les parelles només es desen, i no ens serveixen de res actualment per a ells.
  • Separadament, la correcció de la Contribució més d' àudio a commutació dels laboratoris de veu (també a / privy- settings /, també està desactivat) opteu per omissió per a contribuir a l' àudio dels segments que heu fet bé, usant el text corregit, al conjunt de dades de Voice en CC-BY-SA- 4. 0. Les dues regles són independents bles que podeu atorgar tant, com tampoc.
  • S' esborra l' àudio que s' elimina en 24 hores mitjançant la neteja de l'cron, n' hi ha menys que no hi hagi cap on s' ha optat amb\

Exactitud i errors

La transcripció de l' IA no és perfecta. Els índexs d' error de paraula variaren per l' accent altaveu, qualitat d' àudio, idioma i vocabulari de domini. Per a ús crític (agent, medicina, indústria regulada) es poden verificar contra l' àudio original. Els nostres punts de referència públics WIR per model són a /models/.

Preguntes de composició

Per a la Llei de la Unió Europea, el PIBR, o per altres qüestions de compliment: hello@stt.ai o utilitza la forma de contacte.

Darrera actualització: 2026-08-05.