Política y transparencia de la IA

Qué IA usamos, dónde funciona y cómo cumplimos con los requisitos de divulgación (EU AI Act, artículo 50, efectivo 2026-08-02).

TL;DR

  • Todas las transcripciones son generadas por IA. Cada salida lleva una revelación legible por máquina.
  • Toda la IA se ejecuta en nuestra propia GPU. NO enviamos su audio o texto a OpenAI, Anthropic, Google, o cualquier API LLM de terceros.
  • NO entrenamos modelos básicos en sus transcripciones. Sólo un opt-in fino-tune utiliza correcciones que hace explícitamente.
  • Los clones de voz sintéticos (TTS) están claramente etiquetados como IA generados en nombre de archivo, metadatos y en la página.

Modelos que utilizamos

ModeloUtilizado paraLicenciaCorre
Whisper large-v3-turbo (faster-whisper)Transcripción (por defecto)MITNuestra GPU
STT.ai Enhanced (custom fine-tune)Transcripción (planes pagados)MIT (base) / Proprietary (fine-tune weights)Nuestra GPU
VoskTransmisión de palabras en tiempo realApache 2.0Nuestra GPU
SpeechBrain ECAPA-TDNNDiarización de oradoresApache 2.0Nuestra GPU
MadLAD-400 3BTraducción (450+ idiomas)Apache 2.0Nuestra GPU
Qwen2.5-1.5B (llama.cpp)Resumen, análisis, generación de contenido, chat RAGApache 2.0Nuestra GPU
F5-TTSClonación de voz / texto a vozMITNuestra GPU
all-MiniLM-L6-v2Incrustaciones para búsqueda de RAGApache 2.0Nuestra GPU

No llamamos OpenAI, Anthropic, Google Cloud, ni ninguna API LLM de terceros para ninguna función. Cada modelo anterior se ejecuta en hardware que poseemos y operamos. El único servicio de IA externo que utilizamos es translatapi.ai (también Muddy Holdings) para traducir cadenas de interfaz de usuario — esto nunca toca su contenido transcrito.

Cómo revelamos la generación de IA

  • Páginas HTML de la transcripción: incluir <meta name=\
  • Exportaciones de texto (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): incluir una línea de encabezado 'generada por AI' en la parte superior de cada archivo.
  • Voz sintética / salida TTS: Los archivos WAV incluyen una etiqueta de 'voz sintética' en metadatos y un aviso claro en la página de descarga.
  • Respuestas de la API: incluir un _ai_generado: verdadero campo en cada respuesta JSON que contiene contenido transcrito.

Datos de capacitación

  • Los modelos base (Whisper, MadLAD, Qwen, etc.) vienen pre-entrenados de sus respectivos editores. Los usamos como-enviados.
  • Sus transcripciones NO se utilizan para entrenar modelos de base.
  • Si corrige un segmento de transcripción (el icono del lápiz) o lo marca incorrecto (el icono de la bandera), Y usted ha optado en /privacy-sets/ (\
  • Por otro lado, la herramienta Contribuir correcciones más audio a Voice Lab (también en /privacy-settings/, también desactivada por defecto) le permite contribuir con el audio de los segmentos que corrija, emparejado con el texto corregido, a nuestro conjunto de datos de Voice Lab bajo CC-BY-SA-4.0. Las dos opciones son independientes: puede conceder ambas o ninguna.
  • El audio que subes se elimina en 24 horas a través de la cron cleanup_uploads — A NIVEL de haber optado por \

Precisión y errores

La transcripción de la IA no es perfecta. Las tasas de error de Word varían según el acento del altavoz, la calidad de audio, el idioma y el vocabulario del dominio. Para uso crítico (jurídico, médico, industrias reguladas) verificar contra el audio original. /models/.

Cuestiones relativas al cumplimiento

Para la Ley de IA de la UE, el RGPD u otras cuestiones de cumplimiento: hello@stt.ai o utilizar la formulario de contacto.

Última actualización: 2026-04-26.