Distil-Whisper

STT.ai loop nie hierdie model nie. Hierdie bladsy is verwysingsinligting daaroor. Skryf aan met die modelle wat ons wel hardloop →
5.8%
WER
99
Tale
48.0x
Spoed
MIT
Lisensie

Aangaande Distil-Whisper

Distil-Whisper is 'n gedistilleerde weergawe van Whisper geskep deur Higing Face. Dit verminder die model grootte deur 49% en bereik 6x vinniger inferensie terwyl dit binne 1% WER van die oorspronklike Whisper Groot V2 op buite- van dissipsionele evaluering verstel.
Model InligtingName
  • VerskafferHugging Face
  • Argitektuur-
  • LisensieMIT
  • OpgedateerCancel: Meeting NameMeetingMar 2026

Vrae wat dikwels gevra word

Distil-Whisper is 'n spraak-teksmodel deur Hugging Face. STT.ai loop nie tans Distil-Whisper takies aan hierdie bladsy nie is verwysinginligting oor die model. Vir transkripsie op STT.ai bied die modelpikler die Whisper - gesin (Turbo, Groot V3, Medium, Klein).

Op standaard bankmerke bereik Distil-Whisper om 5.8% Woord Fout tempo. Real-world akkuraatheid hang af van klankgehalte, aksent en taal; vir lawaaierige of gefluurde opnames, verwag 'n paar persentasie punte hoër WER.

Distil-Whisper is nie beskikbaar op STT.ai nie. Sy eie lisensieterme bepaal die loop van dit self. STT.ai se vryvlak dek die Whisper modelle wat ons wel hardloop Ã"r Ã" 600 minute om te begin, dan 'n maandelikse vry top-up.

Distil-Whisper word vrygestel onder MIT, 'n permissiewe open-onse lisensie. Jy kan self-host Distil-Whisper op jou eie hardeware of gebruik ons gegasheer weergawe 2 is kommersieel bruikbaar.

Distil-Whisper ondersteun 99 tale. Outo-speur die regte taal vir die meeste oudio; u kan dit ook self spesifiseer vir 'n klein akkuraatheid.

Distil-Whisper verwerk klank oor ongeveer 48.0x real-time op ons GPUs. 'n 1-hour klank lêer eindig onder 1 minute; langer lêers wag en inkennis stel deur e-pos wanneer dit gedoen word.

Distil-Whisper het 756M parameters. Groter modelle is geneig om akkurater maar stadiger te wees; STT.ai-gashere Distil-Whisper op GPU sodat die parametertelling nie jou kliënt-side-prestasie beïnvloed nie.

Distil-Whisper accepts every format STT.ai supports — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, and others. Output as TXT, SRT, VTT, DOCX, JSON, or PDF.

Ja, Speaker diarisering loop langs Distil-Whisper vir elke transkripsie ium ium word elke spreker gemerk en jy kan hulle na die volgende in die redigeerder hernoem.

Ja. Distil-Whisper loop in ons bestuurde omgewing Lazlo-oudio word verwerk en uitgevee deur verstek en nooit gebruik vir opleiding sonder eksplisiete opt-in nie. Pro planne voeg kliënt-side enkripsie vir transkripsies op res.

Gebruik die vergelyk-stel gereedskap om Distil-Whisper te laat loop teen enige ander ondersteunde model op dieselfde oudio DVD jy sal sien WER, segment tel, luidspreker etikette en vertroue punte kant- by-side. die Distil-Whisper vs Whift Groot V3 vergelyking is die algemeenste hardloop.

Ja. Spesifiseer "distil-whisper" as die model parameter op die /v1/aanteken eindepunt. Python en Node.js SDKs sluit 8800 voorbeelde in. Vry 'nPI-vlak sluit 100 minute/month in.

Ja. Omdat Distil-Whisper MIT-licensed is, kan jy self-host dit. STT.ai se ope-bou-blad gee 'n lys van die projek repo en gewigte. Mees produksiespanne gebruik ons gemoÃ" weergawe om GPU-berigting, model ruilinge en eeps te laat vaar.