Política e transparência da IA

O que usamos, onde funciona e como cumpremos os requisitos de divulgação (A Lei UE sobre IA artigo 50, efetiva 2026-08-02).

TL;DR

  • Todas as transcrições são geradas por IA. Cada saída carrega uma divulgação legível por máquina.
  • Toda IA funciona em nossa própria GPU. NÃO enviamos seu áudio ou texto para OpenAI, Anthropic, Google, ou qualquer API LLM de terceiros.
  • NÃO treinamos modelos de base em suas transcrições. Apenas um opt-in fine-tune usa correções que você faz explicitamente.
  • Os clones de voz sintética (TTS) são claramente rotulados como gerados por IA em nome de ficheiro, metadados e na página.

Modelos que usamos

ModeloUtilizado paraLicençaCorre em cima
Whisper large-v3-turbo (faster-whisper)Transcrição (por omissão)MITNossa UGP
STT.ai Enhanced (custom fine-tune)Transcrição (planos pagos)MIT (base) / Proprietary (fine-tune weights)Nossa UGP
VoskTransmissão de palavras em tempo realApache 2.0Nossa UGP
SpeechBrain ECAPA-TDNNDiarização dos oradoresApache 2.0Nossa UGP
MadLAD-400 3BTradução (450+ línguas)Apache 2.0Nossa UGP
Qwen2.5-1.5B (llama.cpp)Resumo, análise, geração de conteúdo, chat RAGApache 2.0Nossa UGP
F5-TTSClonagem de voz / texto-a- vozMITNossa UGP
all-MiniLM-L6-v2Incluições para busca RAGApache 2.0Nossa UGP

Não chamamos OpenAI, Anthropic, Google Cloud ou qualquer API LLM de terceiros para qualquer funcionalidade. Cada modelo acima é executado no hardware que nós possuímos e operamos. O único serviço externo de IA que usamos é traduzipi.ai (também Muddy Holdings) para traduzir strings de UI — isso nunca toca seu conteúdo transcrito.

Como divulgamos a geração de IA

  • Páginas HTML de transcripción: incluir <meta name=\
  • Exportações de texto (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Incluir uma linha de cabeçalho 'AI-generada' na parte superior de cada arquivo.
  • Voz sintética / saída TTS: Os arquivos WAV incluem uma etiqueta'synthetic-voice' em metadados e um aviso claro na página de download. A desclaim de Audible está no roadmap.
  • Respostas da API: Incluir um _ai_generado: verdadeiro campo em cada resposta JSON que contém conteúdo transcrito.

Dados de formação

  • Modelos de base (Whisper, MadLAD, Qwen, etc.) são pré-adestrados de seus respectivos editores. Usamos-os como navegação.
  • Suas transcrições NÃO são usadas para treinar modelos de base.
  • Se você corrigir um segmento de transcrição (o ícone de lápis) ou marcar incorreto (o ícone da bandeira), e você optou por /privacy-settings/ (\
  • Separadamente, o Contribuir correções mais áudio para o Voice Lab (também em /privacy-settings /, também desligado por padrão) opta por você para contribuir com o áudio dos segmentos que você correto, emparelhado com o texto corrigido, para nosso conjunto de dados do Voice Lab sob CC-BY-SA-4.0. Os dois comutadores são independentes — você pode conceder, ambos ou nenhum.
  • O áudio que você upload é excluído em 24 horas através do cron cron cleanup_uploads — UNLESS você optou por \

Exatidão e erros

A transcrição de IA não é perfeita. As taxas de erro de palavra variam por accento de alto-falante, qualidade de áudio, linguagem e vocabulário de domínio. Para uso crítico (indústrias legais, médicas, regulamentadas) verificar contra o áudio original. Nossos índices de referência de WER públicos por modelo estão em /models/.

Questões de conformidade

No que respeita à lei da UE sobre a IA, ao GDPR ou a outras questões de conformidade: hello@stt.ai ou utilizar o formulário de contacto.

Última atualização: 2026-04-26.