Política e transparência da IA
O que usamos, onde funciona e como cumpremos os requisitos de divulgação (A Lei UE sobre IA artigo 50, efetiva 2026-08-02).
TL;DR
- Todas as transcrições são geradas por IA. Cada saída carrega uma divulgação legível por máquina.
- Toda IA funciona em nossa própria GPU. NÃO enviamos seu áudio ou texto para OpenAI, Anthropic, Google, ou qualquer API LLM de terceiros.
- NÃO treinamos modelos de base em suas transcrições. Apenas um opt-in fine-tune usa correções que você faz explicitamente.
- Os clones de voz sintética (TTS) são claramente rotulados como gerados por IA em nome de ficheiro, metadados e na página.
Modelos que usamos
| Modelo | Utilizado para | Licença | Corre em cima |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transcrição (por omissão) | MIT | Nossa UGP |
| STT.ai Enhanced (custom fine-tune) | Transcrição (planos pagos) | MIT (base) / Proprietary (fine-tune weights) | Nossa UGP |
| Vosk | Transmissão de palavras em tempo real | Apache 2.0 | Nossa UGP |
| SpeechBrain ECAPA-TDNN | Diarização dos oradores | Apache 2.0 | Nossa UGP |
| MadLAD-400 3B | Tradução (450+ línguas) | Apache 2.0 | Nossa UGP |
| Qwen2.5-1.5B (llama.cpp) | Resumo, análise, geração de conteúdo, chat RAG | Apache 2.0 | Nossa UGP |
| F5-TTS | Clonagem de voz / texto-a- voz | MIT | Nossa UGP |
| all-MiniLM-L6-v2 | Incluições para busca RAG | Apache 2.0 | Nossa UGP |
Não chamamos OpenAI, Anthropic, Google Cloud ou qualquer API LLM de terceiros para qualquer funcionalidade. Cada modelo acima é executado no hardware que nós possuímos e operamos. O único serviço externo de IA que usamos é traduzipi.ai (também Muddy Holdings) para traduzir strings de UI — isso nunca toca seu conteúdo transcrito.
Como divulgamos a geração de IA
- Páginas HTML de transcripción: incluir <meta name=\
- Exportações de texto (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Incluir uma linha de cabeçalho 'AI-generada' na parte superior de cada arquivo.
- Voz sintética / saída TTS: Os arquivos WAV incluem uma etiqueta'synthetic-voice' em metadados e um aviso claro na página de download. A desclaim de Audible está no roadmap.
- Respostas da API: Incluir um _ai_generado: verdadeiro campo em cada resposta JSON que contém conteúdo transcrito.
Dados de formação
- Modelos de base (Whisper, MadLAD, Qwen, etc.) são pré-adestrados de seus respectivos editores. Usamos-os como navegação.
- Suas transcrições NÃO são usadas para treinar modelos de base.
- Se você corrigir um segmento de transcrição (o ícone de lápis) ou marcar incorreto (o ícone da bandeira), e você optou por /privacy-settings/ (\
- Separadamente, o Contribuir correções mais áudio para o Voice Lab (também em /privacy-settings /, também desligado por padrão) opta por você para contribuir com o áudio dos segmentos que você correto, emparelhado com o texto corrigido, para nosso conjunto de dados do Voice Lab sob CC-BY-SA-4.0. Os dois comutadores são independentes — você pode conceder, ambos ou nenhum.
- O áudio que você upload é excluído em 24 horas através do cron cron cleanup_uploads — UNLESS você optou por \
Exatidão e erros
A transcrição de IA não é perfeita. As taxas de erro de palavra variam por accento de alto-falante, qualidade de áudio, linguagem e vocabulário de domínio. Para uso crítico (indústrias legais, médicas, regulamentadas) verificar contra o áudio original. Nossos índices de referência de WER públicos por modelo estão em /models/.
Questões de conformidade
No que respeita à lei da UE sobre a IA, ao GDPR ou a outras questões de conformidade: hello@stt.ai ou utilizar o formulário de contacto.
Última atualização: 2026-04-26.