Áudio para texto online grátis
Converta áudio em texto com transcrição por IA. Envie arquivos de áudio, grave pelo microfone ou cole uma URL. Mais de 100 idiomas, 10+ modelos, 98%+ de precisão.
1. Envie o áudio
Envie MP3, WAV, M4A, FLAC, OGG ou qualquer formato de áudio. Até 2GB.
2. A IA processa o áudio
A IA extrai a fala do seu áudio com detecção de falantes e carimbos de tempo.
3. Obtenha sua transcrição
Visualize, edite, baixe ou compartilhe. Exporte como TXT, SRT, VTT, DOCX ou PDF.
Modelos de áudio para texto
Escolha o modelo de IA que atende às suas necessidades — ou deixe-nos escolher o melhor.
Transcrever áudio em mais de 100 idiomas
Pronto para converter áudio em texto?
Comece grátis →Perguntas frequentes
Envie seu arquivo de áudio ou cole uma URL, escolha um modelo de IA e clique em Transcribe. STT.ai devolve texto editável com marcas de tempo e altofalante — a maioria dos arquivos termina em menos de cinco minutos.
MP3, WAV, M4A, FLAC, OGG, AAC, AMR e 10+ mais são todos suportados. Você não precisa converter entre os formatos primeiro — carregar o que seu gravador ou aplicativo produz.
Um pouco. Formatos sem perda como WAV e FLAC transportam áudio perfeito, assim a precisão é limitada apenas pelo modelo e clareza do alto-falante. Formatos com perda (MP3, M4A) em 128 kbps ou superiores são efetivamente idênticos; taxa de bits muito baixas sob 64 kbps pode custar alguns pontos.
Sim. STT.ai inclui 600 minutos gratuitos para começar sem inscrição para o seu primeiro arquivo. Planos pagos a partir de $5/mes adicionar arquivos mais longos, transcrições privadas e processamento de prioridade.
Nossos melhores modelos de áudio limpos atingem a precisão de 95-97% (3-5% Taxa de Erros de Palavra). Ruído de fundo, falantes sobrepostos e acentuamentos fortes são os principais fatores que menor precisão.
Sim. Os usuários gratuitos podem transcribir até uma hora por arquivo; os planos pagos estendem-se a 8+ horas, que abrangem podcasts de comprimento completo, entrevistas e audiobooks em um único passe.
Sim. Diarização do orador etiqueta cada voz (Alvo 1, Falador 2,...) e você pode renomeá-las no editor – trabalha em cada formato e modelo de áudio suportados.
Exporta para TXT, DOCX, PDF, JSON ou SRT/VTT legendas. JSON mantém marcas de tempo legíveis com máquina e rótulos de altofalante; DOCX e PDF são melhores para compartilhar e arquivar.
Sim. 100 mais idiomas com autodetecção, além da opção de definir a linguagem manualmente. áudio de idioma misto é manuseado com troca de arquivo médio, e você pode traduzir o resultado depois.
Sim. O áudio é processado e excluído por padrão, e Pro planos adicionar criptografia do lado do cliente, assim que as transcrições são ilegíveis sem sua chave. Nada é usado para treinamento sem opt-in explícito.
Sim. Pegue um link de qualquer das 1.300+ plataformas suportadas — hosts de podcast, SoundCloud, YouTube e mais — e STT.ai recupera o áudio diretamente. Fontes protegidas pelo DRM não podem ser transcritas.
Sim. A API REST aceita arquivos de áudio diretamente, com Python e Node.js SDKs e uma faixa livre de 100 minutos/mes. Faturação por segundo aplica-se além da nível livre.