Distil-Whisper
STT.ai-ek ez du modelo hau exekutatzen. Orri hau horri buruzko erreferentziazko informazioa da.
Transkribatu exekutatzen ditugun ereduekin →
5.8%
WER
99
Hizkuntzak
48.0x
Abiadura
MIT
Lizentzia
Honi buruz Distil-Whisper
Distil-Whisper Hugging Face-k sortutako Whisper-en bertsio destilatua da. Modeloaren tamaina %49 murrizten du eta inferentzia 6 aldiz azkarragoa lortzen du, jatorrizko Whisper Large V2-ren %1eko WER-a mantenduz banaketaz kanpoko ebaluazio-multzoetan.
Honek onartzen dituen hizkuntzak Distil-Whisper
Modeloaren informazioa
- HornitzaileaHugging Face
- Arkitektura-
- LizentziaMIT
- EguneratutaMar 2026
Maiz egiten diren galderak
Distil-Whisper Hugging Faceren hizketa-testurako modelo bat da. STT.aik ez du Distil-Whisper exekutatzen — orri hau ereduari buruzko erreferentziazko informazioa da. STT.ain transkribatzeko, modelo-hautatzaileak Whisper familia eskaintzen du (Turbo, Large V3, Medium, Small).
Erreferentzia estandarretan, Distil-Whisperk %5.8 inguruko hitzen errore-tasa lortzen du. Benetako zehaztasuna audio-kalitatearen, azentuaren eta hizkuntzaren araberakoa da; grabazio zaratatsu edo azentudunetarako, WER ehuneko puntu batzuk handiagoa espero daiteke.
Distil-Whisper ez dago eskuragarri STT.ain. Bere lizentzia baldintzak agintzen du zuk exekutatzea. STT.airen doako maila Whisper modeloak exekutatzen ditugunak estaltzen ditu - 600 minutu hasteko, eta gero hilean doako gehitu bat.
Distil-Whisper MIT lizentziapean argitaratzen da, kode irekiko lizentzia permisiboa. Zure hardwarean Distil-Whisper ostatatu dezakezu edo gure ostatatutako bertsioa erabili — biak erabil daitezke merkataritzan.
Distil-Whisperk 99 hizkuntza onartzen ditu. Auto-detekzioak hizkuntza egokia hautatzen du audio gehienentzat; eskuz ere zehaztu dezakezu zehaztasun txikiagoa lortzeko.
Distil-Whisper-k audioa 48.0x denbora errealean prozesatzen du gure GPUetan. Ordu bateko audio-fitxategi bat 1 minututan amaitzen da; fitxategi luzeagoak ilaran jarri eta e-postaz jakinarazi egiten dira amaitzen direnean.
Distil-Whisper-k 756M parametro ditu. Modelo handiagoak zehatzagoak izaten dira, baina motelagoak; STT.ai-k Distil-Whisper GPUan gordetzen du, beraz parametroen kopuruak ez du eraginik izango bezeroaren errendimenduan.
Distil-Whisperek STT.aik onartzen dituen formatu guztiak onartzen ditu: MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI eta beste batzuk. Irteera TXT, SRT, VTT, DOCX, JSON edo PDF gisa.
Bai. Hiztun-diarizazioa Distil-Whisperrekin batera exekutatzen da transkribapen bakoitzean — hiztun bakoitza etiketatuta dago eta gero editorean izena aldatu ahal izango duzu.
Bai. Distil-Whisper gure kudeatutako ingurunean exekutatzen da — audioa lehenespenez prozesatu eta ezabatu egiten da, eta ez da inoiz entrenamendurako erabiltzen, aldez aurretik aukeratu gabe. Pro planek bezeroaren aldeko enkriptatzea gehitzen dute transkribapen geldituetan.
Erabili compare-stt tresna Distil-Whisper audio beraren beste edozein onartutako modeloren aurka exekutatzeko — WER, segmentu-kopurua, bozgorailuen etiketak eta konfiantza-puntuak aldi berean ikusiko dituzu. Distil-Whisper eta Whisper Large V3 konparaketa da gehien erabiltzen dena.
Bai. Zehaztu "distil-whisper" modeloaren parametro gisa /v1/transcribe amaierako puntuan. Python eta Node.js SDKek Distil-Whisper adibidea dute. API doako maila 100 minutukoa da hilean.
Bai. Distil-Whisper MIT lizentziaduna denez, zeure burua ostatatu dezakezu. STT.airen kode irekiko orrialdean proiektuaren errepositorioa eta pisuak zerrendatzen dira. Produkzio-talde gehienek gure ostatatutako bertsioa erabiltzen dute GPU-ren erosketak, modeloen trukaketak eta operazioak saltatzeko.