Informar de fallo / Petición de características

Transcribe con Whisper Turbo

Name: Whisper Turbo
Author: OpenAI

Funciona con audio y vídeo de acceso público. El contenido protegido por DRM no es compatible.

Actualizar para mejorar

Transcripciones privadas

Charla con transcripción

Desbloquear con Pro →

Soltar archivo aquí o haga clic para navegar

MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — hasta 2 GB

Cargar varios archivos por lotes con Pro

Actualizar para mejorar

Transcripciones privadas

Charla con transcripción

Desbloquear con Pro →

Actualizar para mejorar

Discurso en tiempo real al texto. IA corrige automáticamente mientras habla — la precisión mejora con un discurso más largo.

Pon a prueba tu micrófono primero

10 min/día gratis 600 min gratis con registro Sin tarjeta de crédito Cifrado

Inscríbete gratis →

5.1%

WER

Idiomas

32.0x

Velocidad

MIT

Licencia

Acerca de Whisper Turbo

Whisper Turbo (large-v3-turbo) es una versión destilada de Whisper Large V3 que reduce drásticamente el tiempo de inferencia al tiempo que mantiene la precisión competitiva. Con sólo 4 capas de decodificador en lugar de 32, consigue una velocidad de 4x.

Idiomas apoyados por Whisper Turbo

Inglés

Español

Francés

Alemán

Chino

Japonés

Coreano

Portugués

Árabe

Hindi

Ruso

Italiano

Neerlandés

Turco

Polaco

Sueco

Indonesio

Tailandés

Vietnamita

Checo

Griego

Rumano

Húngaro

Hebreo

Danés

Finés

Noruego

Ucraniano

Malayo

Bengalí

Información del modelo

ProveedorOpenAI
Arquitectura-
LicenciaMIT
ActualizadoMar 2026

Modelos relacionados

3.2% WER

4.2% WER

3.5% WER

7.8% WER

3.0% WER

Preguntas frecuentes

Whisper Turbo es un modelo de voz a texto de OpenAI. STT.ai aloja Whisper Turbo en nuestra infraestructura de GPU para que pueda usarlo sin aprovisionamiento de su propio hardware — subir audio o vídeo y elegir Whisper Turbo del selector de modelos.

En puntos de referencia estándar, Whisper Turbo alcanza alrededor de 5.1% tasa de error de Word. La precisión en el mundo real depende de la calidad de audio, el acento y el lenguaje; para grabaciones ruidosas o acentuadas, espere unos puntos porcentuales más alto WER.

Whisper Turbo funciona en el nivel gratuito de STT.ai — cada visitante tiene 600 minutos para empezar sin costo. Los planes pagados añaden límites por archivo más largos, transcripciones privadas y cola de prioridad.

Whisper Turbo es lanzado bajo MIT, una licencia de código abierto permisiva. Usted puede auto-anfitriona Whisper Turbo en su propio hardware o utilizar nuestra versión alojada — ambos son comercialmente utilizables.

Whisper Turbo admite 99 idiomas. La detección automática selecciona el idioma adecuado para la mayoría de audio; también puede especificarlo manualmente para un pequeño ascensor de precisión.

Whisper Turbo procesa audio en aproximadamente 32.0x en tiempo real en nuestras GPUs. Un archivo de audio de 1 hora termina en menos de 1 minutos; los archivos más largos cola y notificar por correo electrónico cuando se hace.

Whisper Turbo tiene parámetros 809M. Los modelos más grandes tienden a ser más precisos pero más lentos; STT.ai aloja Whisper Turbo en GPU para que el recuento de parámetros no afecte el rendimiento de su cliente.

Whisper Turbo acepta todos los soportes de formato STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, y otros. Salida como TXT, SRT, VTT, DOCX, JSON o PDF.

Sí. Diarización del altavoz corre junto a Whisper Turbo para cada transcripción - cada altavoz está etiquetado y se puede cambiar el nombre en el editor después.

Sí. Whisper Turbo se ejecuta en nuestro entorno gestionado — audio se procesa y elimina por defecto y nunca se utiliza para el entrenamiento sin opt-in explícito. Planes Pro añadir cifrado del lado del cliente para transcripciones en reposo.

Utilice la herramienta compare-stt para ejecutar Whisper Turbo contra cualquier otro modelo soportado en el mismo audio: verá WER, conteo de segmentos, etiquetas de altavoz y puntuaciones de confianza lado a lado. La comparación Whisper Turbo vs Whisper Large V3 es la más común.

Sí. Especifique "whisper-turbo" como parámetro de modelo en el endpoint /v1/transcribir. Los SDKs de Python y Node.js incluyen Whisper Turbo ejemplos. El nivel de API libre incluye 100 minutos/mes.

Sí. Debido a que Whisper Turbo es licenciada MIT, usted puede auto-anfitrionarlo. STT.ai's página de código abierto lista la repo proyecto y pesos. La mayoría de los equipos de producción utilizan nuestra versión alojada para saltarse la adquisición de GPU, modelos swaps, y ops.

Transcribe con Whisper Turbo

Acerca de Whisper Turbo

Idiomas apoyados por Whisper Turbo

Información del modelo

Modelos relacionados

Preguntas frecuentes

¿Qué es Whisper Turbo?

¿Qué tan exacto es Whisper Turbo?

¿Es Whisper Turbo libre de usar?

¿Qué licencia usa Whisper Turbo?

¿Cuántos idiomas soportan Whisper Turbo?

¿Qué tan rápido es Whisper Turbo?

¿Qué tan grande es el modelo Whisper Turbo?

¿Qué formatos de audio pueden transcribir Whisper Turbo?

¿Detecta Whisper Turbo varios altavoces?

¿Mis datos son privados al usar Whisper Turbo?

¿Cómo se compara Whisper Turbo con otros modelos STT?

¿Puedo utilizar Whisper Turbo a través de la API?

¿Puedo ejecutar Whisper Turbo en mi propio servidor?