Distil-Whisper
STT.ai executa pas aqueste modèl. Aquesta pagina es una referéncia d'informacions sus el.
Transcriure amb los modèls que se fan executar →
5.8%
WER
99
Lengas
48.0x
Velocitat
MIT
Licéncia
A prepaus de Distil-Whisper
Distil-Whisper es una version distillada de Whisper creada per Hugging Face. Redusís la talha del modèl de 49% e realiza una inferéncia 6 còps mai rapida en mantenent dins 1% WER de l'original Whisper Large V2 sus d'ensembles d'evaluacion fora de distribucion.
Entresenhas sul modèl
- ProvesidorHugging Face
- Arquitectura-
- LicénciaMIT
- ActualizatMar 2026
Questions frequentas
Distil-Whisper is a speech-to-text model by Hugging Face. STT.ai does not currently run Distil-Whisper — this page is reference information about the model. For transcription on STT.ai, the model picker offers the Whisper family (Turbo, Large V3, Medium, Small).
@ info
Lo Distil-Whisper es pas disponible sul STT.ai. Las condicions de la licéncia lo regisson. Lo nivèl liure del STT.ai cobrís los modèls Whisper que nos cal utilizar - 600 minutas per començar, puèi un recargament mensal liure.
Distil-Whisper es publicat jos la licéncia MIT, una licéncia de còde dobèrt permissiva. Podètz auto-ostejar Distil-Whisper sus vòstre pròpri maquinari o utilizar nòstra version ostejada — ambedos son comercialament utilizables.
Distil-Whisper pren en carga 99 lengas. La deteccion automatica causís la lenga correcta per la majoritat dels sons; podètz tanben la especificar manualament per una precision melhorada.
Distil-Whisper traça l'audio a aperaquí 48.0x en temps real sus nòstras GPU. Un fichièr àudio d'una ora se acaba en mens de 1 minutas; los fichièrs mai longs son plaçats en fila e notificats per corrièr electronic quand son acabats.
Distil-Whisper a de paramètres 756M. Los modèls mai grands son mai precises mas mai lents; STT.ai òste Distil-Whisper sul GPU, doncas lo compte de paramètres afecta pas vòstras performanças del costat client.
Distil-Whisper accepta totes los formats que pren en carga STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, e d'autres. Sortida coma TXT, SRT, VTT, DOX, JSON, o PDF.
@ info: shell
@ info
Utilizatz l'aisina compare-stt per comparar Distil-Whisper amb quin autre modèl suportat sul meteis audio — veiretz WER, lo comptatge de segments, las etiquetas dels parlants e las pontuacions de fiabilitat a costat. La comparason Distil-Whisper vs Whisper Large V3 es la mai comuna.
Òc. Especifiquez "distil-whisper" coma paramètre del modèl sul punt de fin /v1/transcribe. Los SDK Python e Node.js incluson d'exemples Distil-Whisper. Lo nivèl API liure inclutz 100 minutas/mes.
Òc. Perque Distil-Whisper es licenciat amb MIT, podètz l'albergar. La pagina de còde dobèrt de STT.ai lista lo repositori e los pes del projècte. La majoritat de las equipas de produccion utilizan nòstra version albergada per passar l'aquisicion de GPU, los escambis de modèls e las operacions.