Áudio para texto online grátis

Converta áudio em texto com transcrição a IA. Envie arquivos de áudio, recorde do seu microfone, ou cole um URL. 100 mais idiomas, modelos abertos, 98% mais precisão.

Funciona com áudio e vídeo disponível publicamente. O conteúdo protegido por DRM não é suportado.

Atualização para Melhorado
Transcrição privada
Conversa com transcrição
Desbloquear com Pro →
Deixe aqui o arquivo ou clique para navegar
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — até 2GB
Atualização para Melhorado
Transcrição privada
Conversa com transcrição
Desbloquear com Pro →
Atualização para Melhorado
Gravação: 0:00
Em tempo real Vosk (instante)
Melhorado Whisper (exacto)
Ligações públicas: 24h, texto apenas · Inscrever-se para 7d + áudio · Pro para as ligações privadas

A fala em tempo real ao texto. A IA auto-correge ao mesmo tempo que você fala — a precisão melhora com a fala mais longa.

Teste o seu microfone primeiro
❤️ Diz aos teus amigos!
Usaste as transcrições livres.

Cadastre-se gratuitamente para obter 600 minutos, ou atualização de 9 dólares/mes para milhares mais.

10 min/dia livre 600 min livre com inscrição Não há cartão de crédito Cifrado
Inscrever-se gratuitamente →

1. Envie o áudio

Envie MP3, WAV, M4A, FLAC, OGG ou qualquer formato de áudio. Até 2GB.

2. A IA processa o áudio

A IA extrai a fala do seu áudio com detecção de falantes e carimbos de tempo.

3. Obtenha sua transcrição

Visualize, edite, baixe ou compartilhe. Exporte como TXT, SRT, VTT, DOCX ou PDF.

Formatos de áudio suportados

Modelos de áudio para texto

Escolha o modelo de IA que atende às suas necessidades — ou deixe-nos escolher o melhor.

Casos de uso de áudio para texto

Pronto para converter áudio em texto?

Comece grátis →

Perguntas frequentes

Envie seu arquivo de áudio ou cole uma URL, escolha um modelo de IA e clique em Transcribe. STT.ai devolve texto editável com marcas de tempo e altofalante — a maioria dos arquivos termina em menos de cinco minutos.

MP3, WAV, M4A, FLAC, OGG, AAC, AMR e 10+ mais são todos suportados. Você não precisa converter entre os formatos primeiro — carregar o que seu gravador ou aplicativo produz.

Um pouco. Formatos sem perda como WAV e FLAC transportam áudio perfeito, assim a precisão é limitada apenas pelo modelo e clareza do alto-falante. Formatos com perda (MP3, M4A) em 128 kbps ou superiores são efetivamente idênticos; taxa de bits muito baixas sob 64 kbps pode custar alguns pontos.

Sim. STT.ai inclui 600 minutos gratuitos por mês sem inscrição para o seu primeiro arquivo. Planos pagos a partir de 9 dólares/mes adicionar arquivos mais longos, transcrições privadas e processamento de prioridade.

Nossos melhores modelos de áudio limpos atingem a precisão de 95-97% (3-5% Taxa de Erros de Palavra). Ruído de fundo, falantes sobrepostos e acentuamentos fortes são os principais fatores que menor precisão.

Sim. Os usuários gratuitos podem transcribir até uma hora por arquivo; os planos pagos estendem-se a 8+ horas, que abrangem podcasts de comprimento completo, entrevistas e audiobooks em um único passe.

Sim. Diarização do orador etiqueta cada voz (Alvo 1, Falador 2,...) e você pode renomeá-las no editor – trabalha em cada formato e modelo de áudio suportados.

Exporta para TXT, DOCX, PDF, JSON ou SRT/VTT legendas. JSON mantém marcas de tempo legíveis com máquina e rótulos de altofalante; DOCX e PDF são melhores para compartilhar e arquivar.

Sim. 100 mais idiomas com autodetecção, além da opção de definir a linguagem manualmente. áudio de idioma misto é manuseado com troca de arquivo médio, e você pode traduzir o resultado depois.

Sim. O áudio é processado e excluído por padrão, e Pro planos adicionar criptografia do lado do cliente, assim que as transcrições são ilegíveis sem sua chave. Nada é usado para treinamento sem opt-in explícito.

Sim. Pegue um link de qualquer das 1.300+ plataformas suportadas — hosts de podcast, SoundCloud, YouTube e mais — e STT.ai recupera o áudio diretamente. Fontes protegidas pelo DRM não podem ser transcritas.

Sim. A API REST aceita arquivos de áudio diretamente, com Python e Node.js SDKs e uma faixa livre de 100 minutos/mes. Faturação por segundo aplica-se além da nível livre.