Free Speech to Text en linha

Convertir la votz en tèxt amb la transcripcion AI. Telecargar de fichièrs àudio, enregistrar amb vòstre microfòn o colar una URL. Mai de 100 lengas, modèls dobèrts, precision de mai de 98%.

Funciona amb de fichièrs àudio e vidèo publics. Lo contengut protegit per DRM es pas suportat.

@ info: status
@ info: status
Discutir amb transcripcion
Desverrollar amb Pro →
@ info: status
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM - fins a 2 Go
@ info: status
@ info: status
Discutir amb transcripcion
Desverrollar amb Pro →
@ info: status
Enregistrament: 0:00
Temps real Cira (imediata)
Enriquit Whisper (precis)
Public links: 24h, text only · Enregistrar for 7d + audio · Pro for private links

Transformar la votz en tèxt en temps real. L'IA se corrigís automaticament mentre que parlatz - la precision melhora amb la durada de la votz.

Testatz lo vòstre microfòn en primièr
❤️ Ador STT.ai ? Ditz-lo als vòstres amics !
Avètz utilizat vòstras transcripcions liuras

Inscriu-te de biais liure per recebre 600 minutas, o amplifica't de $9/mes per de milièrs de mai.

10 minutas liuras/ jorn 600 min gratuit amb inscripcion Pas cap de carta de credit EncriptatComment
Inscriure' s →

Enregistrament vocal

Telecargar un fichièr àudio o vidèo, colar una URL, o enregistrar de discors a partir de vòstre microfòn.

2. AI convertit la votz en tèxt

Causir lo modèl Whisper que correspond a vòstre audio. Deteccion del locutor e deteccion automatica de la lenga inclusas.

3. Exportar vòstra transcripcion

Telecargar en 6 formats. Partejar de ligams de transcripcion amb lectura àudio.

Formats de picada vocala suportats

Models de sintèsi vocala en tèxt

Seleccionatz lo modèl d'IA que correspond a vòstres besonhs — o nos permetètz de causir lo melhor.

Sintetizar la votz en tèxt en mai de 100 lengas

Comment=Transformador de votz en tèxt

@ info: status

Començar liure →

Questions frequentas

La conversion vocala en tèxt (també nomenada reconeissença vocala o ASR) convertis automaticament l'audio parlat en mots escrichs. STT.ai executa vòstre enregistrament a travèrs d'un modèl d'IA qu'escóta l'audio e produsís un tèxt editable amb de marcadors de temps e d'etiquetas de locutor — pas de picada necessària.

Un modèl acústic transforma la forma d'onda del son en fonèmas, puèi un modèl de lenga los assembla dins los mots e la puntuacion mai probables. STT.ai fa aquò sus GPU amb la familha Whisper (Large V3 e Turbo), doncas un enregistrament d'una ora se fa normalament en 2-3 minutas.

Yes. Every visitor gets 600 free minutes per month with no signup required for your first file. Paid plans start at $9/month and add longer files, private transcripts, and priority processing.

@ info

Òc. Parlatz dins vòstre microfòn e STT.ai difusa la transcripcion en dirècte a travèrs de l'aisina de transcripcion en dirècte. Podètz tanben cargar un enregistrament acabat per una transcripcion per lot se ne volètz pas parlar mot per mot.

STT.ai reconeis mai de 100 lengas e detecta automaticament la lenga parlada per la majoritat dels documents audio. Podètz tanben definir la lenga manualmente per una melhora precision, e los enregistraments en lengas mixtas son gestionats en cambiant a mièg clip.

@ info: status

STT.ai accepta mai de 20 formats, coma MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM e AVI. Sortida en TXT, SRT, VTT, DOCX, JSON o PDF.

La sintèsi vocala transcriu çò que se ditz en mots; la reconeissença vocala (identificacion del locutor) determina qui lo ditz. STT.ai fa ambedos — transcripcion e diarizacion del locutor — mas los tèrmes descrivon de tascas diferentas.

Yes. Audio is processed and deleted by default. Pro plans add client-side encryption so transcripts are unreadable without your key, even to STT.ai, and your data is never used for model training without explicit opt-in.

Òc. STT.ai a una API REST amb Python e Node.js SDKs mai un servidor MCP per Claude e Cursor. Lo nivèl API liure inclutz 100 minutas/mes, amb facturacion per segonda al delà.

@ info: status