Política e transparencia da IA
Que IA usamos, onde se executa, e como cumprimos cos requisitos de divulgación (EU AI Act Article 50, efectivo 2026-08-02).
TL; DR
- Todas as transcricións son xeradas por IA. Cada saída leva unha revelación lexíbel por máquina.
- Toda a IA executase na nosa propia GPU. NON enviamos o seu son ou texto a OpenAI, Anthropic, Google ou a API de LLM de terceiros.
- Non adestramos modelos base nas súas transcricións. Só un axuste fino opcional usa as correccións que vostede fai explicitamente.
- Os clons de voz sintética (TTS) están claramente etiquetados como xerados por IA no nome do ficheiro, nos metadatos e na páxina.
Modelos que usamos
| Modelo | Empregado para | Licenza | Executado |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transcrición (predeterminado) | MIT | A nosa GPU |
| STT.ai Enhanced (custom fine-tune) | Transcrición (planos de pago) | MIT (base) / Proprietary (fine-tune weights) | A nosa GPU |
| Vosk | Fluxo de palabras en tempo real | Apache 2.0 | A nosa GPU |
| SpeechBrain ECAPA-TDNN | Diarización do orador | Apache 2.0 | A nosa GPU |
| MadLAD-400 3B | Tradución (máis de 450 linguas) | Apache 2.0 | A nosa GPU |
| Qwen2.5-1.5B (llama.cpp) | Resumo, análise, xeración de contido, conversas RAG | Apache 2.0 | A nosa GPU |
| F5-TTS | Clonaxe de voz / texto- a- voz | MIT | A nosa GPU |
| all-MiniLM-L6-v2 | Inclusións para procuras RAG | Apache 2.0 | A nosa GPU |
Non chamamos a OpenAI, Anthropic, Google Cloud, ou a API de LLM de terceiros para ningunha funcionalidade. Todos os modelos de riba executanse no hardware que posuímos e operamos. O único servizo de IA externo que usamos é translateapi. ai (tamén Muddy Holdings) para traducir as cadeas da interface de usuario - isto nunca toca o contido transcrito.
Como revelamos a xeración de IA
- Transcrición de páxinas HTML: include < meta name=\
- Exportacións de texto (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): incluír unha liña de cabeceira « transcripción xerada por IA » no principio de cada ficheiro.
- Saída de voz sintética / TTS: Os ficheiros WAV inclúen unha etiqueta « synthetic- voice » nos metadatos e un aviso claro na páxina de descarga. A exención de responsabilidade audible está no mapa.
- Respostas da API: incluír un campo _ ai_ generated: true en cada resposta JSON que conteña contido transcrito.
Datos de adestramento
- Os modelos base (Whisper, MadLAD, Qwen, etc.) veñen pre- adestrados dos seus respectivos editores. Empréganos como se envían.
- As súas transcricións non se empregan para adestrar modelos base.
- Se corrixe un segmento da transcrición (a icona do lapis) ou o marca como incorrecto (a icona da bandeira), E se optou por / confidencialidade / (\
- Por separado, a opción Contribuir coas correccións e o son ao Laboratorio de Voz (tamén en / confidencialidade- configuración/, tamén desactivada por omisión) permite que se contribúa co son dos segmentos que corrixa, xunto co texto corrixido, ao conxunto de datos do Laboratorio de Voz baixo CC- BY- SA- 4. 0. As dúas opcións son independentes: pode conceder unha, ambas ou ningunha.
- O son que envíe é borrado no prazo de 24 horas mediante o cron cleanup_ uploads — A MENOS QUE teña activado \
Precisión e erros
A transcrición da IA non é perfecta. As taxas de erro das palabras varían segundo o acento do falante, a calidade do son, a lingua e o vocabulario do dominio. Para uso crítico (legais, médicos, industrias reguladas) verifique co son orixinal. As nosas referencias públicas de WER por modelo están en /models/.
Preguntas de compatibilidade
Para preguntas sobre a Lei de IA da UE, o RGPD ou outras cuestións de cumprimento: hello@stt.ai ou empregar o Contacto.
Última actualización: 2026-04-26.