Gravador de voz e transcritor online
Grave áudio do microfone e obtenha transcrição instantânea. Grátis, sem cadastro.
Ouvindo...
Clique para começar a gravar
Seu áudio é transcrito em tempo real
Gravando
00:00
Como o gravador de voz funciona
1. Clique em Gravar
Permita o acesso ao microfone e comece a falar
2. Veja o texto ao vivo
As palavras aparecem enquanto você fala em tempo real
3. Exportar
Copie, baixe ou compartilhe sua transcrição
Precisas de transcrição completa, não apenas de uma ferramenta?
Envie áudio ou vídeo, ou cole um link — transcrição de IA em 100 mais idiomas com detecção de alto-falantes. 10 minutos livres por dia, sem inscrição.
Perguntas frequentes
gravação de voz executa no seu navegador: cole uma URL, upload um arquivo ou registro de seu mic. STT.ai escolhe o modelo IA e retorna a transcrição em menos de 5 minutos. Exporte como TXT, SRT, VTT, DOCX, JSON ou PDF.
Sim — cada visitante recebe 600 minutos livres para começar em STT.ai, utilizável para gravação de voz o mesmo que qualquer outro fluxo de trabalho. Planos pagos a partir de 5 dólares/mes desbloquear arquivos mais longos, transcrições privadas e fila de espera prioritária.
gravação de voz funciona nos mesmos modelos de IA que o resto de STT.ai — nossos melhores modelos chegam a 95-97% de precisão em fala limpa (3-5% de taxa de erro de Word em índices de referência).
gravação de voz pode funcionar em qualquer um dos 10+ modelos STT.ai — STT.ai Melhorados (mais precisos), Whisper Grande V3 (99 idiomas), NVIDIA Canary (#1 WER em langs suportados), Whisper Turbo (rápido), Moonshine (peso leve), e muito mais.
Sim. Cada transcrição exporta como SRT ou VTT — funciona com YouTube, Vimeo, TikTok, VLC e todos os principais reprodutores de vídeo. A ferramenta queima-subtítulos os sobrepõe em vídeo como hardsubs.
Sim. Diarização de falantes automaticamente etiqueta cada voz (Alvo 1, Falador 2,...) e você pode renomeá-las no editor incorporado. Funciona em todos os modelos e idiomas.
A maioria de gravação de voz trabalhos termina em menos de 5 minutos. Um arquivo de áudio de 1 hora geralmente se completa em 2-3 minutos com os nossos modelos mais rápidos. A velocidade depende do modelo escolhido e da carga atual da GPU.
gravação de voz aceita 20+ formatos — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, e muito mais. Saída para TXT, SRT, VTT, DOCX, JSON ou PDF.
Sim. Os arquivos de áudio enviados a gravação de voz são processados e excluídos por padrão. Pro planos adicionar criptografia do lado do cliente — mesmo que o banco de dados de STT.ai seja violado, suas transcrições são ilegíveis sem sua chave. Os dados nunca são usados para o treinamento de modelos sem opt-in explícito.
Sim. STT.ai oferece uma API REST com Python e Node.js SDKs, mais um servidor MCP para Claude e Cursor — tudo utilizável para gravação de voz fluxos de trabalho. O nível de API grátis inclui 100 minutos/mes.
Sim. Cada transcrição abre no editor incorporado onde você pode corrigir palavras, renomear altofalantes, ajustar selos de tempo e adicionar notas. Todas as alterações salvem automaticamente.
Cada transcrição recebe uma URL compartilhável única. Exporta para DOCX ou PDF para e-mail. Pro planos adicionar links protegidos por senha e permanentes — útil para o trabalho do cliente.
STT.ai manipula mais de 1.300 plataformas, incluindo YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, hosts de podcast, e muito mais. Transcripcion de URL funciona com conteúdo disponível apenas — fontes protegidas pelo DRM não podem ser transcritas.