IA livre Discurso ao texto

Transcriba áudio e vídeo em texto em mais de 100 idiomas. Múltiplos modelos de Whisper. Detecção de altofalante. Não é necessário inscrição.

12K
transcrições
290.2K
minutos transcritos
100+
Línguas
70+
ferramentas livres

Funciona com áudio e vídeo disponível publicamente. O conteúdo protegido por DRM não é suportado.

Atualização para Melhorado
Transcrição privada
Conversa com transcrição
Desbloquear com Pro →
Deixe aqui o arquivo ou clique para navegar
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — até 2GB
Atualização para Melhorado
Transcrição privada
Conversa com transcrição
Desbloquear com Pro →
Atualização para Melhorado
Gravação: 0:00
Em tempo real Vosk (instante)
Melhorado Whisper (exacto)
Ligações públicas: 24h, texto apenas · Inscrever-se para 7d + áudio · Pro para as ligações privadas

A fala em tempo real ao texto. A IA auto-correge ao mesmo tempo que você fala — a precisão melhora com a fala mais longa.

Teste o seu microfone primeiro
❤️ Diz aos teus amigos!
Usaste as transcrições livres.

Cadastre-se gratuitamente para obter 600 minutos, ou atualize de $5/mes para milhares mais.

10 min/dia livre 600 min livre com inscrição Não há cartão de crédito Cifrado
Inscrever-se gratuitamente →
Armazenamento criptografado do lado do cliente — As suas transcrições estão cifradas no seu navegador, mesmo que não as possamos ler. Aprenda como funciona →

Como funciona STT.ai

Três passos para a transcrição precisa

1. Carregar, gravar ou Pegar URL

Arraste e largue qualquer arquivo de áudio ou vídeo (MP3, WAV, MP4, e 20+ formatos). Grave o seu microfone em tempo real. Ou cole um link de YouTube, Vimeo, TikTok e 1.300+ plataformas.

2. AI Transcribe com a sua escolha do modelo

Escolha o modelo de Whisper que se adapta: Melhorado (grande-v3, mais preciso), Turbo (rápido, o padrão), Médio ou Pequeno. Detecção automática de linguagem de 99 opções. Diarização de falantes identifica quem disse o que.

3. Exportar, partilhar ou integrar

Baixe como TXT, SRT, VTT, DOCX, JSON ou PDF. Compartilhe através do link. Use nossa API para integrar a transcrição no seu aplicativo. Perfeito para legendas, notas de reunião, podcasts e muito mais.

100+
Línguas Suportadas
70+
Ferramentas Livres
1,300+
Plataformas Suportadas
7
Formatos de exportação

Desenvolvedor-Primeira API

Integrar a fala-a-texto em seus aplicativos em minutos. API RESTful com streaming WebSocket em tempo real.

REST + WebSocket — Upload de arquivos e streaming em tempo real
Múltiplos modelos — Whisper Turbo, grande V3, médio e pequeno
Diarização dos oradores — Auto-detecção quem disse o que
Produção flexível — JSON, TXT, SRT, VTT com selos de tempo de palavra
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Pronto para transcribir?

Envie seu primeiro arquivo grátis. Sem cartão de crédito, sem inscrição. 600 minutos para começar no plano gratuito.

Comece a traduzir

Perguntas frequentes

discurso a texto executa no seu navegador: cole uma URL, upload um arquivo ou registro de seu mic. STT.ai escolhe o modelo IA e retorna a transcrição em menos de 5 minutos. Exporte como TXT, SRT, VTT, DOCX, JSON ou PDF.

Sim — cada visitante recebe 600 minutos livres para começar em STT.ai, utilizável para discurso a texto o mesmo que qualquer outro fluxo de trabalho. Planos pagos a partir de 5 dólares/mes desbloquear arquivos mais longos, transcrições privadas e fila de espera prioritária.

discurso a texto funciona nos mesmos modelos de IA que o resto de STT.ai — nossos melhores modelos chegam a 95-97% de precisão em fala limpa (3-5% de taxa de erro de Word em índices de referência).

discurso a texto pode funcionar em qualquer um dos modelos de Whisper STT.ai hosts — STT.ai Melhorado (Whisper grande v3, mais preciso, em planos pagos), Whisper grande V3, Whisper Turbo (rápido), Whisper Meio e Whisper Pequeno.

Sim. Cada transcrição exporta como SRT ou VTT — funciona com YouTube, Vimeo, TikTok, VLC e todos os principais reprodutores de vídeo. A ferramenta queima-subtítulos os sobrepõe em vídeo como hardsubs.

Sim. Diarização de falantes automaticamente etiqueta cada voz (Alvo 1, Falador 2,...) e você pode renomeá-las no editor incorporado. Funciona em todos os modelos e idiomas.

A maioria de discurso a texto trabalhos termina em menos de 5 minutos. Um arquivo de áudio de 1 hora geralmente se completa em 2-3 minutos com os nossos modelos mais rápidos. A velocidade depende do modelo escolhido e da carga atual da GPU.

discurso a texto aceita 20+ formatos — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, e muito mais. Saída para TXT, SRT, VTT, DOCX, JSON ou PDF.

Sim. Os arquivos de áudio enviados a discurso a texto são processados e excluídos por padrão. Pro planos adicionar criptografia do lado do cliente — mesmo que o banco de dados de STT.ai seja violado, suas transcrições são ilegíveis sem sua chave. Os dados nunca são usados para o treinamento de modelos sem opt-in explícito.

Sim. STT.ai oferece uma API REST com Python e Node.js SDKs, mais um servidor MCP para Claude e Cursor — tudo utilizável para discurso a texto fluxos de trabalho. O nível de API grátis inclui 100 minutos/mes.

Sim. Cada transcrição abre no editor incorporado onde você pode corrigir palavras, renomear altofalantes, ajustar selos de tempo e adicionar notas. Todas as alterações salvem automaticamente.

Cada transcrição recebe uma URL compartilhável única. Exporta para DOCX ou PDF para e-mail. Pro planos adicionar links protegidos por senha e permanentes — útil para o trabalho do cliente.

STT.ai manipula mais de 1.300 plataformas, incluindo YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, hosts de podcast, e muito mais. Transcripcion de URL funciona com conteúdo disponível apenas — fontes protegidas pelo DRM não podem ser transcritas.