Política e transparencia da IA

Que IA usamos, onde se executa, e como cumprimos cos requisitos de divulgación (EU AI Act Article 50, efectivo 2026-08-02).

TL; DR

  • Todas as transcricións son xeradas por IA. Cada saída leva unha revelación lexíbel por máquina.
  • Toda a IA executase na nosa propia GPU. NON enviamos o seu son ou texto a OpenAI, Anthropic, Google ou a API de LLM de terceiros.
  • Non adestramos modelos base nas súas transcricións. Só un axuste fino opcional usa as correccións que vostede fai explicitamente.
  • Os clons de voz sintética (TTS) están claramente etiquetados como xerados por IA no nome do ficheiro, nos metadatos e na páxina.

Modelos que usamos

ModeloEmpregado paraLicenzaExecutado
Whisper large-v3-turbo (faster-whisper)Transcrición (predeterminado)MITA nosa GPU
STT.ai Enhanced (custom fine-tune)Transcrición (planos de pago)MIT (base) / Proprietary (fine-tune weights)A nosa GPU
VoskFluxo de palabras en tempo realApache 2.0A nosa GPU
SpeechBrain ECAPA-TDNNDiarización do oradorApache 2.0A nosa GPU
MadLAD-400 3BTradución (máis de 450 linguas)Apache 2.0A nosa GPU
Qwen2.5-1.5B (llama.cpp)Resumo, análise, xeración de contido, conversas RAGApache 2.0A nosa GPU
F5-TTSClonaxe de voz / texto- a- vozMITA nosa GPU
all-MiniLM-L6-v2Inclusións para procuras RAGApache 2.0A nosa GPU

Non chamamos a OpenAI, Anthropic, Google Cloud, ou a API de LLM de terceiros para ningunha funcionalidade. Todos os modelos de riba executanse no hardware que posuímos e operamos. O único servizo de IA externo que usamos é translateapi. ai (tamén Muddy Holdings) para traducir as cadeas da interface de usuario - isto nunca toca o contido transcrito.

Como revelamos a xeración de IA

  • Transcrición de páxinas HTML: include < meta name=\
  • Exportacións de texto (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): incluír unha liña de cabeceira « transcripción xerada por IA » no principio de cada ficheiro.
  • Saída de voz sintética / TTS: Os ficheiros WAV inclúen unha etiqueta « synthetic- voice » nos metadatos e un aviso claro na páxina de descarga. A exención de responsabilidade audible está no mapa.
  • Respostas da API: incluír un campo _ ai_ generated: true en cada resposta JSON que conteña contido transcrito.

Datos de adestramento

  • Os modelos base (Whisper, MadLAD, Qwen, etc.) veñen pre- adestrados dos seus respectivos editores. Empréganos como se envían.
  • As súas transcricións non se empregan para adestrar modelos base.
  • Se corrixe un segmento da transcrición (a icona do lapis) ou o marca como incorrecto (a icona da bandeira), E se optou por / confidencialidade / (\
  • Por separado, a opción Contribuir coas correccións e o son ao Laboratorio de Voz (tamén en / confidencialidade- configuración/, tamén desactivada por omisión) permite que se contribúa co son dos segmentos que corrixa, xunto co texto corrixido, ao conxunto de datos do Laboratorio de Voz baixo CC- BY- SA- 4. 0. As dúas opcións son independentes: pode conceder unha, ambas ou ningunha.
  • O son que envíe é borrado no prazo de 24 horas mediante o cron cleanup_ uploads — A MENOS QUE teña activado \

Precisión e erros

A transcrición da IA non é perfecta. As taxas de erro das palabras varían segundo o acento do falante, a calidade do son, a lingua e o vocabulario do dominio. Para uso crítico (legais, médicos, industrias reguladas) verifique co son orixinal. As nosas referencias públicas de WER por modelo están en /models/.

Preguntas de compatibilidade

Para preguntas sobre a Lei de IA da UE, o RGPD ou outras cuestións de cumprimento: hello@stt.ai ou empregar o Contacto.

Última actualización: 2026-04-26.