Transcripción en vivo en línea gratis

Transcripción en vivo con IA. Hable a su micrófono y vea sus palabras como texto en tiempo real. Más de 100 idiomas, 10+ modelos, 98%+ de precisión.

Funciona con audio y vídeo de acceso público. El contenido protegido por DRM no es compatible.

Actualizar para mejorar
Transcripciones privadas
Charla con transcripción
Desbloquear con Pro →
Soltar archivo aquí o haga clic para navegar
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — hasta 2 GB
Actualizar para mejorar
Transcripciones privadas
Charla con transcripción
Desbloquear con Pro →
Actualizar para mejorar
Grabación: 0:00
En tiempo real Vosk (instante)
Mejorado Susurro (exacto)
Enlaces públicos: 24h, sólo texto · Inscríbete para 7d + audio · Pro para enlaces privados

Discurso en tiempo real al texto. IA corrige automáticamente mientras habla — la precisión mejora con un discurso más largo.

Pon a prueba tu micrófono primero
❤️ ¡Díselo a tus amigos!
Has usado tus transcripciones gratis.

Inscríbete gratis para obtener 600 minutos, o actualizar desde $5/mes por miles más.

10 min/día gratis 600 min gratis con registro Sin tarjeta de crédito Cifrado
Inscríbete gratis →

1. Haga clic en grabar

Haga clic en el botón del micrófono y comience a hablar. Sus palabras aparecen al instante.

2. La IA transcribe en vivo

Vosk proporciona palabras instantáneas. Whisper autocorrige para mayor precisión mientras habla.

3. Mejorar y compartir

Mejore con transcripción IA completa. Descargue, comparta o guarde en su cuenta.

También transcriba archivos pregrabados

Casos de uso de transcripción en vivo

¿Listo para probar la transcripción en vivo?

Comenzar gratis →

Preguntas frecuentes

La transcripción en vivo convierte el discurso en texto en tiempo real mientras hablas, en lugar de después de que una grabación termine. STT.ai transmite las palabras a la pantalla dentro de un segundo o dos de ser hablado.

Haga clic en el micrófono, permita el acceso al micrófono cuando su navegador le solicita, y comience a hablar — los subtítulos aparecen en vivo. Para subtitular una reunión o reproducción de vídeo en su computadora, compartir el audio del sistema en lugar del micrófono.

Normalmente de uno a dos segundos entre el discurso y el texto. La latencia depende de la red y la carga actual de la GPU; una conexión estable mantiene los subtítulos fluyendo sin problemas sin grandes huecos.

Funciona en Chrome actual, Edge, Firefox, y Safari en el escritorio y el móvil, utilizando el micrófono estándar y APIs WebSocket. No se requiere plugin o descarga; sólo concédele permiso para el micrófono.

Sí. STT.ai incluye 600 minutos gratis para comenzar la transcripción en vivo. Planes pagados a partir de $ 5 / mes añadir sesiones más largas, transcripciones privadas, y streaming de prioridad.

La transcripción en vivo alcanza el 90-95% en el habla clara, ligeramente por debajo de la transcripción por lotes porque el modelo se compromete a las palabras en tiempo real en lugar de revisar toda la grabación.

Sí. Apunte la transcripción en vivo en el audio del evento (micrónico o del sistema de audio) y muestre los subtítulos en pantalla para la accesibilidad. También puede guardar la transcripción completa cuando la sesión termine.

Sí. Se admiten más de 100 idiomas. Establezca el idioma antes de comenzar para obtener los resultados en tiempo real más fiables, ya que la detección automática necesita un momento de audio para bloquear el idioma.

Sí. Cuando se detiene, la sesión en vivo se guarda como una transcripción completa que puede editar, cambiar el nombre de los altavoces y exportar a TXT, DOCX, PDF, SRT o VTT.

Sí. El altavoz dariliza las etiquetas de las voces durante la sesión, y después puedes renombrarlas a nombres reales en la transcripción guardada.

Sí. El audio transmitido se procesa en tiempo real y no se retiene más allá de la producción de la transcripción, que se elimina por defecto. Los planes Pro añaden cifrado del lado del cliente para la transcripción guardada.

Las palabras lag y caídas suelen venir de una red inestable o hablar lejos del micrófono. Una conexión Wi-Fi cableada o fuerte y un micrófono más cercano mantienen los subtítulos en tiempo real precisos y a tiempo.