Política y transparencia de la IA
Qué IA usamos, dónde funciona y cómo cumplimos con los requisitos de divulgación (EU AI Act, artículo 50, efectivo 2026-08-02).
TL;DR
- Todas las transcripciones son generadas por IA. Cada salida lleva una revelación legible por máquina.
- Toda la IA se ejecuta en nuestra propia GPU. NO enviamos su audio o texto a OpenAI, Anthropic, Google, o cualquier API LLM de terceros.
- NO entrenamos modelos básicos en sus transcripciones. Sólo un opt-in fino-tune utiliza correcciones que hace explícitamente.
- Los clones de voz sintéticos (TTS) están claramente etiquetados como IA generados en nombre de archivo, metadatos y en la página.
Modelos que utilizamos
| Modelo | Utilizado para | Licencia | Corre |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transcripción (por defecto) | MIT | Nuestra GPU |
| STT.ai Enhanced (custom fine-tune) | Transcripción (planes pagados) | MIT (base) / Proprietary (fine-tune weights) | Nuestra GPU |
| Vosk | Transmisión de palabras en tiempo real | Apache 2.0 | Nuestra GPU |
| SpeechBrain ECAPA-TDNN | Diarización de oradores | Apache 2.0 | Nuestra GPU |
| MadLAD-400 3B | Traducción (450+ idiomas) | Apache 2.0 | Nuestra GPU |
| Qwen2.5-1.5B (llama.cpp) | Resumen, análisis, generación de contenido, chat RAG | Apache 2.0 | Nuestra GPU |
| F5-TTS | Clonación de voz / texto a voz | MIT | Nuestra GPU |
| all-MiniLM-L6-v2 | Incrustaciones para búsqueda de RAG | Apache 2.0 | Nuestra GPU |
No llamamos OpenAI, Anthropic, Google Cloud, ni ninguna API LLM de terceros para ninguna función. Cada modelo anterior se ejecuta en hardware que poseemos y operamos. El único servicio de IA externo que utilizamos es translatapi.ai (también Muddy Holdings) para traducir cadenas de interfaz de usuario — esto nunca toca su contenido transcrito.
Cómo revelamos la generación de IA
- Páginas HTML de la transcripción: incluir <meta name=\
- Exportaciones de texto (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): incluir una línea de encabezado 'generada por AI' en la parte superior de cada archivo.
- Voz sintética / salida TTS: Los archivos WAV incluyen una etiqueta de 'voz sintética' en metadatos y un aviso claro en la página de descarga.
- Respuestas de la API: incluir un _ai_generado: verdadero campo en cada respuesta JSON que contiene contenido transcrito.
Datos de capacitación
- Los modelos base (Whisper, MadLAD, Qwen, etc.) vienen pre-entrenados de sus respectivos editores. Los usamos como-enviados.
- Sus transcripciones NO se utilizan para entrenar modelos de base.
- Si corrige un segmento de transcripción (el icono del lápiz) o lo marca incorrecto (el icono de la bandera), Y usted ha optado en /privacy-sets/ (\
- Por otro lado, la herramienta Contribuir correcciones más audio a Voice Lab (también en /privacy-settings/, también desactivada por defecto) le permite contribuir con el audio de los segmentos que corrija, emparejado con el texto corregido, a nuestro conjunto de datos de Voice Lab bajo CC-BY-SA-4.0. Las dos opciones son independientes: puede conceder ambas o ninguna.
- El audio que subes se elimina en 24 horas a través de la cron cleanup_uploads — A NIVEL de haber optado por \
Precisión y errores
La transcripción de la IA no es perfecta. Las tasas de error de Word varían según el acento del altavoz, la calidad de audio, el idioma y el vocabulario del dominio. Para uso crítico (jurídico, médico, industrias reguladas) verificar contra el audio original. /models/.
Cuestiones relativas al cumplimiento
Para la Ley de IA de la UE, el RGPD u otras cuestiones de cumplimiento: hello@stt.ai o utilizar la formulario de contacto.
Última actualización: 2026-04-26.