Ferramenta de transcrição online gratuita
Envie um arquivo, grave pelo microfone ou cole uma URL. A IA transcreve em segundos.
100+ idiomas
Detecção automática ou seleção manual. Todos os principais idiomas suportados.
Detecção de falantes
Identifica automaticamente quem disse o quê.
Criptografia do lado do cliente
Criptografe transcrições no navegador. Nem nós podemos lê-las.
6 formatos de exportação
TXT, SRT, VTT, DOCX, JSON, PDF.
Formatos de áudio e vídeo suportados
Envie arquivos de até 2GB. Suportamos mais de 1.300 plataformas — basta colar a URL. Ver todas as plataformas →
Funciona com áudio e vídeo disponível publicamente. O conteúdo protegido por DRM não é suportado.
Como funciona
1
Envie ou grave
Envie um arquivo de áudio/vídeo, cole uma URL do YouTube ou qualquer plataforma, ou grave pelo microfone.
2
A IA transcreve
Escolha entre vários modelos de IA. Detecção automática de idioma. A diarização identifica quem disse o quê.
3
Exporte e compartilhe
Baixe como TXT, SRT, VTT, DOCX, JSON ou PDF. Compartilhe com um link. Melhore com IA para maior precisão.
Perguntas frequentes
transcrição executa no seu navegador: cole uma URL, upload um arquivo ou registro de seu mic. STT.ai escolhe o modelo IA e retorna a transcrição em menos de 5 minutos. Exporte como TXT, SRT, VTT, DOCX, JSON ou PDF.
Sim — cada visitante recebe 600 minutos livres para começar em STT.ai, utilizável para transcrição o mesmo que qualquer outro fluxo de trabalho. Planos pagos a partir de 5 dólares/mes desbloquear arquivos mais longos, transcrições privadas e fila de espera prioritária.
transcrição funciona nos mesmos modelos de IA que o resto de STT.ai — nossos melhores modelos chegam a 95-97% de precisão em fala limpa (3-5% de taxa de erro de Word em índices de referência).
transcrição pode funcionar em qualquer um dos 10+ modelos STT.ai — STT.ai Melhorados (mais precisos), Whisper Grande V3 (99 idiomas), NVIDIA Canary (#1 WER em langs suportados), Whisper Turbo (rápido), Moonshine (peso leve), e muito mais.
Sim. Cada transcrição exporta como SRT ou VTT — funciona com YouTube, Vimeo, TikTok, VLC e todos os principais reprodutores de vídeo. A ferramenta queima-subtítulos os sobrepõe em vídeo como hardsubs.
Sim. Diarização de falantes automaticamente etiqueta cada voz (Alvo 1, Falador 2,...) e você pode renomeá-las no editor incorporado. Funciona em todos os modelos e idiomas.
A maioria de transcrição trabalhos termina em menos de 5 minutos. Um arquivo de áudio de 1 hora geralmente se completa em 2-3 minutos com os nossos modelos mais rápidos. A velocidade depende do modelo escolhido e da carga atual da GPU.
transcrição aceita 20+ formatos — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, e muito mais. Saída para TXT, SRT, VTT, DOCX, JSON ou PDF.
Sim. Os arquivos de áudio enviados a transcrição são processados e excluídos por padrão. Pro planos adicionar criptografia do lado do cliente — mesmo que o banco de dados de STT.ai seja violado, suas transcrições são ilegíveis sem sua chave. Os dados nunca são usados para o treinamento de modelos sem opt-in explícito.
Sim. STT.ai oferece uma API REST com Python e Node.js SDKs, mais um servidor MCP para Claude e Cursor — tudo utilizável para transcrição fluxos de trabalho. O nível de API grátis inclui 100 minutos/mes.
Sim. Cada transcrição abre no editor incorporado onde você pode corrigir palavras, renomear altofalantes, ajustar selos de tempo e adicionar notas. Todas as alterações salvem automaticamente.
Cada transcrição recebe uma URL compartilhável única. Exporta para DOCX ou PDF para e-mail. Pro planos adicionar links protegidos por senha e permanentes — útil para o trabalho do cliente.
STT.ai manipula mais de 1.300 plataformas, incluindo YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, hosts de podcast, e muito mais. Transcripcion de URL funciona com conteúdo disponível apenas — fontes protegidas pelo DRM não podem ser transcritas.