Transcribe with Vosk
12.0%
WER
20
Languages
100.0x
Speed
Apache 2.0
License
About Vosk
Languages Supported by Vosk
Model Info
- ProviderAlpha Cephei
- Architecture-
- LicenseApache 2.0
- UpdatedMar 2026
Кўп бериладиган саволлар
Vosk Alpha Cephei томонидан сўздан матнга моделдир. STT.ai Vosk ни GPU инфратузилмасида сақлайди, шунинг учун сиз уни ўз жиҳозингизни таъминламасдан фойдалана оласиз — аудио ёки видео юклаб олиб, Vosk ни модел танловчидан танлайсиз.
Стандарт бенчмаркларда Vosk та сўз хатосининг 12.0% га етишини кўрсатади. Ҳақиқий аниқлик аудио сифати, акцент ва тилга боғлиқ; шовқинли ёки акцентли ёзувлар учун WER дан бир неча фоиз юқори бўлишини кутиш мумкин.
Vosk STT.ai'нинг бепул даражасида ишлайди — ҳар бир меҳмон ойига 600 дақиқа бепул олади. Умумий тарифлар ҳар бир файл учун узоқроқ чегараларни, шахсий транскриптларни ва устувор навбатни қўшиб беради.
Vosk Apache 2.0 лицензияси остида чиқарилган, бу оммавий очиқ манбали лицензиядир. Сиз Vosk ни ўз қурилмангизда ёки бизнинг хост қилинган версиямизда ўзингизга жойлаштирсангиз бўлади — иккаласи ҳам савдо учун ишлатилиши мумкин.
Vosk 20 тилларни қўллаб-қувватлайди. Авто-таърифлаш кўплаб аудио учун тўғри тилни танлайди; сиз уни кичик аниқлик учун қўлда ҳам белгилашингиз мумкин.
Vosk аудиони GPUларда 100.0x реал вақтда ишлайди. 1 соатлик аудио файл 1 дақиқада тугайди; узун файллар навбатда туради ва тугаганида электрон почта орқали хабар беради.
Vosk нинг 50M параметрлари бор. Кўпроқ моделлар аниқроқ, аммо секинроқ; STT.ai GPUда Vosk ни қабул қилади, шунинг учун параметрлар сони сизнинг клиент томони ишлашингизга таъсир қилмайди.
Vosk STT.ai қўллаб-қувватлайдиган барча форматларни қабул қилади — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI ва бошқалар. Тўқима TXT, SRT, VTT, DOCX, JSON ёки PDF шаклида.
Ҳа. Ҳар бир транскрипция учун Vosk билан биргаликда сўзловчилар рўйхати ишлайди - ҳар бир сўзловчи белгиланади ва кейинчалик уларни редакторда қайта номлашингиз мумкин.
Ҳа. Vosk бизнинг бошқариладиган муҳитда ишлайди — аудио ишланади ва стандарт тарзда ўчирилади ва ҳеч қачон очиқ танловсиз машғулот учун фойдаланилмайди. Pro режалари дам олганда ёзилган транскриптлар учун клиент томони шифрлашини қўшиб беради.
Vosk'ни бошқа қўллаб-қувватланадиган моделлар билан бир хил аудиода ишлатиш учун compare-stt асбобидан фойдаланинг — сиз WER, сегментлар сони, овоз берувчиларнинг белгилари ва ишончлилик балларини бир-бирига қарама-қарши кўришингиз мумкин. Vosk ва Whisper Large V3 ўртасидаги таққослашни энг кўп ишлатиш мумкин.
Ҳа. /v1/transcribe охирида "vosk" модели параметрини кўрсатинг. Python ва Node.js SDK лар Vosk мисолларни ўз ичига олади. Бепул API даражаси ойига 100 дақиқани ўз ичига олади.
Ҳа. Vosk Apache 2.0 лицензиясига эга бўлгани учун, сиз уни ўзингиз хост қила оласиз. STT.ai'нинг очиқ манба саҳифасида лойиҳа репозиторияси ва вазнлари кўрсатилган. Продукция жамоаларининг кўпчилиги GPU харид қилиш, модел алмаштириш ва ишга тушириш учун бизнинг хост қилинган версиямизни фойдаланади.