Distil-Whisper
Цю модель не запущено з STT.ai. Про неї можна дізнатися з цієї сторінки.
Приписуйтесь до моделей, які ми бігаємо →
5.8%
WER
99
Мови
48.0x
Швидкість
MIT
Ліцензія
Про програму Distil-Whisper
Disitle- Whisper - це дистильована версія Whsper створеної Higper. Вона зменшує розмір моделі на 49% і досягає 6x швидких вирахувань, утримуючи у межах 1% Whiper big V2 наборах нерозподілу.
Мови, що підтримуються Distil-Whisper
Інформація про модель
- ПровайдерHugging Face
- Архітектура-
- ЛіцензіяMIT
- ОновленоMar 2026
Часті запитання
Distil-Whisper is a speech-to-text model by Hugging Face. STT.ai does not currently run Distil-Whisper — this page is reference information about the model. For transcription on STT.ai, the model picker offers the Whisper family (Turbo, Large V3, Medium, Small).
За стандартними полями Distil-Whisper досягає приблизно 5.8% Частота помилок за словами. Точність реального світу залежить від якості звуку, акценту та мови; для галасливих або акцентованих записів очікується на декількох відсоткових пунктах вищого WER.
Distil-Whisper is not available on STT.ai. Its own licence terms govern running it yourself. STT.ai's free tier covers the Whisper models we do run — 600 minutes to start, then a monthly free top-up.
Distil-Whisper is released under MIT, a permissive open-source license. You can self-host Distil-Whisper on your own hardware or use our hosted version — both are commercially usable.
Distil-Whisper підтримують 99 мови. Автовиявлення обирає правильну мову для більшості звукових файлів; ви також можете вказати її вручну для невеличкого підйому точності.
Distil-Whisper processes audio at about 48.0x real-time on our GPUs. A 1-hour audio file finishes in under 1 minutes; longer files queue and notify by email when done.
Distil-Whisper має 8882 параметри. Великі моделі зазвичай є точнішими, але повільнішими; STT.ai вузлів - Distil-Whisper на GPU, отже кількість параметрів не впливає на швидкодію вашого клієнта.
Distil-Whisper приймає кожен формат STT.ai підтримує MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI та інші. Вивід у вигляді TXT, SRT, VTT, DOCX, JSON або PDF.
Так. diamer diaarization працює поряд Distil-Whisper на кожен запис, кожен з промов буде позначено, і ви зможете перейменувати їх у редакторі після цього.
Yes. Distil-Whisper runs in our managed environment — audio is processed and deleted by default and never used for training without explicit opt-in. Pro plans add client-side encryption for transcripts at rest.
Скористайтеся інструментом порівняння- stest, щоб запустити Distil-Whisper у порівнянні з будь- якою іншою моделлю, що підтримується, на одному і тому ж звуковому каналі, ви побачите WER, кількість сегментів, надписи промовців, а також результати довіри збоку. Порівняння Distil-Whisper проти Wisper Великий V3 є найбільш поширеним.
Так. Вкажіть " distil-whisper " як параметр моделі у теці / v1/ trancess кінцевій точці. У назвах Python і вузла. js SDKs містяться Distil-Whisper приклади. У вільний інтерфейс API міститься 100 хвилин/ місяців.
Так. Оскільки Distil-Whisper має 8882- ліцензію, ви можете виконати її. STT.ai - на сторінці з відкритим кодом наведено список експропріаторів та ваг. Більшість команд з виробництва використовують нашу власницьку версію для того, щоб пропустити закупівлю на GPU, моделі свопінгу і ops.