Áudio para texto online grátis

Converta áudio em texto com transcrição por IA. Envie arquivos de áudio, grave pelo microfone ou cole uma URL. Mais de 100 idiomas, 10+ modelos, 98%+ de precisão.

Funciona com áudio e vídeo disponível publicamente. O conteúdo protegido por DRM não é suportado.

Atualização para Melhorado
Transcrição privada
Conversa com transcrição
Desbloquear com Pro →
Deixe aqui o arquivo ou clique para navegar
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — até 2GB
Atualização para Melhorado
Transcrição privada
Conversa com transcrição
Desbloquear com Pro →
Atualização para Melhorado
Gravação: 0:00
Em tempo real Vosk (instante)
Melhorado Whisper (exacto)
Ligações públicas: 24h, texto apenas · Inscrever-se para 7d + áudio · Pro para as ligações privadas

A fala em tempo real ao texto. A IA auto-correge ao mesmo tempo que você fala — a precisão melhora com a fala mais longa.

Teste o seu microfone primeiro
❤️ Diz aos teus amigos!
Usaste as transcrições livres.

Cadastre-se gratuitamente para obter 600 minutos, ou atualize de $5/mes para milhares mais.

10 min/dia livre 600 min livre com inscrição Não há cartão de crédito Cifrado
Inscrever-se gratuitamente →

1. Envie o áudio

Envie MP3, WAV, M4A, FLAC, OGG ou qualquer formato de áudio. Até 2GB.

2. A IA processa o áudio

A IA extrai a fala do seu áudio com detecção de falantes e carimbos de tempo.

3. Obtenha sua transcrição

Visualize, edite, baixe ou compartilhe. Exporte como TXT, SRT, VTT, DOCX ou PDF.

Formatos de áudio suportados

Casos de uso de áudio para texto

Pronto para converter áudio em texto?

Comece grátis →

Perguntas frequentes

Envie seu arquivo de áudio ou cole uma URL, escolha um modelo de IA e clique em Transcribe. STT.ai devolve texto editável com marcas de tempo e altofalante — a maioria dos arquivos termina em menos de cinco minutos.

MP3, WAV, M4A, FLAC, OGG, AAC, AMR e 10+ mais são todos suportados. Você não precisa converter entre os formatos primeiro — carregar o que seu gravador ou aplicativo produz.

Um pouco. Formatos sem perda como WAV e FLAC transportam áudio perfeito, assim a precisão é limitada apenas pelo modelo e clareza do alto-falante. Formatos com perda (MP3, M4A) em 128 kbps ou superiores são efetivamente idênticos; taxa de bits muito baixas sob 64 kbps pode custar alguns pontos.

Sim. STT.ai inclui 600 minutos gratuitos para começar sem inscrição para o seu primeiro arquivo. Planos pagos a partir de $5/mes adicionar arquivos mais longos, transcrições privadas e processamento de prioridade.

Nossos melhores modelos de áudio limpos atingem a precisão de 95-97% (3-5% Taxa de Erros de Palavra). Ruído de fundo, falantes sobrepostos e acentuamentos fortes são os principais fatores que menor precisão.

Sim. Os usuários gratuitos podem transcribir até uma hora por arquivo; os planos pagos estendem-se a 8+ horas, que abrangem podcasts de comprimento completo, entrevistas e audiobooks em um único passe.

Sim. Diarização do orador etiqueta cada voz (Alvo 1, Falador 2,...) e você pode renomeá-las no editor – trabalha em cada formato e modelo de áudio suportados.

Exporta para TXT, DOCX, PDF, JSON ou SRT/VTT legendas. JSON mantém marcas de tempo legíveis com máquina e rótulos de altofalante; DOCX e PDF são melhores para compartilhar e arquivar.

Sim. 100 mais idiomas com autodetecção, além da opção de definir a linguagem manualmente. áudio de idioma misto é manuseado com troca de arquivo médio, e você pode traduzir o resultado depois.

Sim. O áudio é processado e excluído por padrão, e Pro planos adicionar criptografia do lado do cliente, assim que as transcrições são ilegíveis sem sua chave. Nada é usado para treinamento sem opt-in explícito.

Sim. Pegue um link de qualquer das 1.300+ plataformas suportadas — hosts de podcast, SoundCloud, YouTube e mais — e STT.ai recupera o áudio diretamente. Fontes protegidas pelo DRM não podem ser transcritas.

Sim. A API REST aceita arquivos de áudio diretamente, com Python e Node.js SDKs e uma faixa livre de 100 minutos/mes. Faturação por segundo aplica-se além da nível livre.