Distil-Whisper

STT.ai ne pokreće ovaj model. Ova stranica je referentne informacije o njemu. Transcrib s modelima koje vodimo →
5.8%
WER
99
Jezici
48.0x
Brzina
MIT
Dozvola

O Distil-Whisper

Distil-Whisper je destilirana verzija Whisper stvorena od Hugging Face. Smanjuje veličinu modela za 49% i postiže 6x brži zaključak dok se održava unutar 1% WER od originalnog WHIP velikog V2 na van distribucijske evaluacije skupova.

Česta pitanja

Distil-Whisper je model govora-na-teksta od Hugging Face. STT.ai trenutno ne radi Distil-Whisper – ova stranica je referentne informacije o modelu. Za transkripciju na STT.ai, model birač nudi Whisper obitelji (Turbo, Veliki V3, Srednji, Mali).

Na standardnim mjerilima, Distil-Whisper postiže oko 5.8% Word Pogreška. Preciznost stvarnog svijeta ovisi o kvaliteti zvuka, naglasku i jeziku; za bučne ili naglasene snimke, očekujte nekoliko postotka više WER.

Distil-Whisper nije dostupan na STT.ai. Njezina vlastita dozvola uvjeti upravljaju ga sami. STT.ai je besplatni niz pokriva Whisper modele koje radimo – 600 minuta za početak, a zatim mjesečni besplatni top-up.

Distil-Whisper je pušten pod MIT, popustljiva dozvola otvorenog izvora. Možete samostalno voditi Distil-Whisper na vlastitom hardveru ili koristiti našu domaću verziju – oboje su komercijalno upotrebljivi.

Distil-Whisper podržava 99 jezika. Auto-detekcija bira pravi jezik za većinu zvuka; možete ga također ručno navesti za mali preciznost lift.

Distil-Whisper procesa zvuka na oko 48.0x real-time na našem GPU-u. Jedan sat audio datoteka završava u manje od 8802 minuta; duže datoteke redak i obavijestite e-mailom kada se uradi.

Distil-Whisper ima 8802 parametra. Veći modeli su točniji, ali sporije; STT.ai domaćina Distil-Whisper na GPU tako da broj parametara ne utječe na performanse vašeg klijenta.

Distil-Whisper prihvaća svaki oblik STT.ai podrške — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI i ostali. Izlaz kao TXT, SRT, VTT, DOCX, JSON, ili PDF.

Da. Zvučnička dijarizacija teče uz Distil-Whisper za svaku transkripciju — svaki govornik je označen i možete ih nakon toga preimenovati u uredniku.

Da. Distil-Whisper trči u našem upravljanom okruženju – audio se obrađuje i briše uobičajeno i nikada se ne koristi za trening bez eksplicitne opt-in. Pro planovi dodati klijent-strana enkripcija za transkripte u miru.

Koristite alat usporedbe-stt za pokretanje Distil-Whisper protiv bilo kojeg drugog podržanog modela na istom zvuku – vidjet ćete WER, broj segmenta, zvučnike, i samopouzdanje rezultate strane-ba-side. Distil-Whisper protiv Whisper Veliki V3 usporedba je najčešće pokrenuti.

Da. Navedite "distil-whisper" kao parametar modela na /v1/transcribe ishodu. Python i Node.js SDKs uključuju Distil-Whisper primjera. Besplatni API stupanj uključuje 100 minuta/mjesec.

Da. Budući da je Distil-Whisper je 8802-licensirana, možete ga samostalno voditi. STT.ai stranica otvorenog izvora popisuje repo i utege projekta. Većina proizvodnih timova koristi našu domaćinu za preskočenje GPU nabave, modela swaps, i ops.