Transcribe with Whisper Large V3
4.2%
WER
99
Languages
8.0x
Speed
MIT
License
About Whisper Large V3
Model Info
- ProviderOpenAI
- Architecture-
- LicenseMIT
- UpdatedMar 2026
Кўп бериладиган саволлар
Whisper Large V3 OpenAI томонидан сўздан матнга моделдир. STT.ai Whisper Large V3 ни GPU инфратузилмасида сақлайди, шунинг учун сиз уни ўз жиҳозингизни таъминламасдан фойдалана оласиз — аудио ёки видео юклаб олиб, Whisper Large V3 ни модел танловчидан танлайсиз.
Стандарт бенчмаркларда Whisper Large V3 та сўз хатосининг 4.2% га етишини кўрсатади. Ҳақиқий аниқлик аудио сифати, акцент ва тилга боғлиқ; шовқинли ёки акцентли ёзувлар учун WER дан бир неча фоиз юқори бўлишини кутиш мумкин.
Whisper Large V3 STT.ai'нинг бепул даражасида ишлайди — ҳар бир меҳмон ойига 600 дақиқа бепул олади. Умумий тарифлар ҳар бир файл учун узоқроқ чегараларни, шахсий транскриптларни ва устувор навбатни қўшиб беради.
Whisper Large V3 MIT лицензияси остида чиқарилган, бу оммавий очиқ манбали лицензиядир. Сиз Whisper Large V3 ни ўз қурилмангизда ёки бизнинг хост қилинган версиямизда ўзингизга жойлаштирсангиз бўлади — иккаласи ҳам савдо учун ишлатилиши мумкин.
Whisper Large V3 99 тилларни қўллаб-қувватлайди. Авто-таърифлаш кўплаб аудио учун тўғри тилни танлайди; сиз уни кичик аниқлик учун қўлда ҳам белгилашингиз мумкин.
Whisper Large V3 аудиони GPUларда 8.0x реал вақтда ишлайди. 1 соатлик аудио файл 7 дақиқада тугайди; узун файллар навбатда туради ва тугаганида электрон почта орқали хабар беради.
Whisper Large V3 нинг 1.55B параметрлари бор. Кўпроқ моделлар аниқроқ, аммо секинроқ; STT.ai GPUда Whisper Large V3 ни қабул қилади, шунинг учун параметрлар сони сизнинг клиент томони ишлашингизга таъсир қилмайди.
Whisper Large V3 STT.ai қўллаб-қувватлайдиган барча форматларни қабул қилади — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI ва бошқалар. Тўқима TXT, SRT, VTT, DOCX, JSON ёки PDF шаклида.
Ҳа. Ҳар бир транскрипция учун Whisper Large V3 билан биргаликда сўзловчилар рўйхати ишлайди - ҳар бир сўзловчи белгиланади ва кейинчалик уларни редакторда қайта номлашингиз мумкин.
Ҳа. Whisper Large V3 бизнинг бошқариладиган муҳитда ишлайди — аудио ишланади ва стандарт тарзда ўчирилади ва ҳеч қачон очиқ танловсиз машғулот учун фойдаланилмайди. Pro режалари дам олганда ёзилган транскриптлар учун клиент томони шифрлашини қўшиб беради.
Whisper Large V3'ни бошқа қўллаб-қувватланадиган моделлар билан бир хил аудиода ишлатиш учун compare-stt асбобидан фойдаланинг — сиз WER, сегментлар сони, овоз берувчиларнинг белгилари ва ишончлилик балларини бир-бирига қарама-қарши кўришингиз мумкин. Whisper Large V3 ва Whisper Large V3 ўртасидаги таққослашни энг кўп ишлатиш мумкин.
Ҳа. /v1/transcribe охирида "whisper-large-v3" модели параметрини кўрсатинг. Python ва Node.js SDK лар Whisper Large V3 мисолларни ўз ичига олади. Бепул API даражаси ойига 100 дақиқани ўз ичига олади.
Ҳа. Whisper Large V3 MIT лицензиясига эга бўлгани учун, сиз уни ўзингиз хост қила оласиз. STT.ai'нинг очиқ манба саҳифасида лойиҳа репозиторияси ва вазнлари кўрсатилган. Продукция жамоаларининг кўпчилиги GPU харид қилиш, модел алмаштириш ва ишга тушириш учун бизнинг хост қилинган версиямизни фойдаланади.