Transcribe with Distil-Whisper
5.8%
WER
99
Languages
48.0x
Speed
MIT
License
About Distil-Whisper
Model Info
- ProviderHugging Face
- Architecture-
- LicenseMIT
- UpdatedMar 2026
Veelgestelde vragen
Distil-Whisper is een speech-to-text model van Hugging Face. STT.ai hosts Distil-Whisper op onze GPU-infrastructuur, zodat u het kunt gebruiken zonder het voorzien van uw eigen hardware te uploaden audio of video en kies Distil-Whisper uit de model picker.
Op standaard benchmarks bereikt Distil-Whisper ongeveer 5.8% Word Error Rate. Real-world nauwkeurigheid is afhankelijk van audiokwaliteit, accent en taal; voor lawaaierige of geaccentueerde opnames, verwachten een paar procentpunten hoger WER.
Distil-Whisper draait op STT.ai's gratis tier. Elke bezoeker krijgt 600 minuten / maand zonder kosten. Betaalde plannen toevoegen van langere per-bestand grenzen, prive-transcripts, en prioriteit in de wachtrij.
Distil-Whisper wordt vrijgegeven onder MIT, een permissieve open-source licentie. U kunt zelf-host Distil-Whisper op uw eigen hardware of gebruik maken van onze gehoste versie zijn beide commercieel bruikbaar.
Distil-Whisper ondersteunt 99 talen. Autodetectie kiest de juiste taal voor de meeste audio; u kunt het ook handmatig specificeren voor een kleine nauwkeurigheid lift.
Distil-Whisper verwerkt audio op ongeveer 48.0x real-time op onze GPU's. Een 1-uurs audiobestand eindigt in minder dan 1 minuten; langere files wachtrij en melding per e-mail wanneer gedaan.
Distil-Whisper heeft 756M parameters. Grotere modellen hebben de neiging om nauwkeuriger maar langzamer te zijn; STT.ai hosts Distil-Whisper op GPU zodat de parametertelling geen invloed heeft op de prestaties van uw client-side.
Distil-Whisper accepteert elk formaat dat STT.ai ondersteunt. MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, en anderen. Output als TXT, SRT, VTT, DOCX, JSON, of PDF.
Ja. Speaker diarization loopt naast Distil-Whisper voor elke transcriptie • elke speaker is gelabeld en je kunt ze hernoemen in de editor achteraf.
Ja. Distil-Whisper wordt uitgevoerd in onze beheerde omgeving audio wordt verwerkt en verwijderd standaard en nooit gebruikt voor training zonder expliciete opt-in. Pro plannen toevoegen client-side encryptie voor transcripten in rust.
Gebruik de compare-stt tool om Distil-Whisper uit te voeren tegen elk ander ondersteund model op dezelfde audio, zie je WER, segment count, speaker labels, en vertrouwen scoort side-by-side. De Distil-Whisper vs Whisper Large V3 vergelijking is de meest voorkomende run.
Ja. Geef "distil-whisper" op als de modelparameter op het /v1/transcribe eindpunt. Python en Node.js SDK's bevatten Distil-Whisper voorbeelden. Gratis API tier bevat 100 minuten/maand.
Ja. Omdat Distil-Whisper is MIT-licentie, kunt u zelf-hosten. STT.ai open-source pagina bevat de project repo en gewichten. De meeste productieteams gebruiken onze gehoste versie om GPU inkoop over te slaan, model swaps, en ops.