Transcribe with Whisper Large V3
4.2%
WER
99
Languages
8.0x
Speed
MIT
License
About Whisper Large V3
Model Info
- ProviderOpenAI
- Architecture-
- LicenseMIT
- UpdatedMar 2026
Часта задаваемыя пытанні
Whisper Large V3 - гэта мадэль пераўтварэння мовы ў тэкст ад OpenAI. STT.ai размяшчае Whisper Large V3 на нашай інфраструктуры GPU, таму вы можаце выкарыстоўваць яго без стварэння свайго апаратнага забеспячэння - загрузіце аўдыё або відэа і выберыце Whisper Large V3 з выбару мадэлі.
На стандартных тэставанні, Whisper Large V3 дасягае каля 4.2% Word Error Rate. Рэальная дакладнасць залежыць ад якасці гуку, акцэнту і мовы; для шумных або акцэнтаваных запісаў чакайце на некалькі працэнтных пунктаў вышэй WER.
Whisper Large V3 працуе на бясплатным узроўні STT.ai — кожны наведвальнік атрымлівае 600 хвілін / месяц бясплатна. Плацежныя планы дадаюць большыя абмежаванні на файл, прыватныя транскрыпты і прыярытэтнае чаканне.
Whisper Large V3 выпушчаны пад ліцэнзіяй MIT, дазваляе адкрыты код. Вы можаце самастойна ўсталяваць Whisper Large V3 на вашым камп' ютары або выкарыстоўваць нашу версію - абодва могуць быць выкарыстаны ў камерцыйных мэтах.
Whisper Large V3 падтрымлівае 99 моў. Аўтаматычнае выяўленне выбірае правільную мову для большасці гукаў; вы таксама можаце вызначыць яе ўручную для невялікага павышэння дакладнасці.
Whisper Large V3 апрацоўвае аўдыё з хуткасцю 8.0x у рэальным часе на нашых GPU. 1- гадзінны аўдыё файл скончыцца менш чым за 7 хвіліны; даўжэйшыя файлы будуць адпраўляцца ў чаргу і абвяшчаць па электроннай пошце, калі яны будуць завершаны.
Whisper Large V3 мае параметры 1.55B. Большыя мадэлі больш дакладныя, але павольнейшыя; STT.ai мае Whisper Large V3 на GPU, таму колькасць параметраў не ўплывае на хуткасць працы кліента.
Whisper Large V3 прымае ўсе фарматы, якія падтрымлівае STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI і іншыя. Вывад у фармаце TXT, SRT, VTT, DOCX, JSON або PDF.
Так. Дыярызацыя гукавых файлаў працуе разам з Whisper Large V3 для кожнай транскрыпцыі - кожны гукавы файл мае этыкетку, і вы можаце змяніць яго назву ў рэдактара пасля.
Так. Whisper Large V3 працуе ў нашым кіруемым асяроддзі - гук апрацоўваецца і выдаляецца па змаўчанні і ніколі не выкарыстоўваецца для трэніровак без выразнага дазволу. Планы Pro дадаюць шыфраванне з боку кліента для транскрыптаў у спакоі.
Выкарыстоўвайце інструмент compare-stt, каб правесці параўнанне Whisper Large V3 з любым іншым падтрымліваемым мадэллю на тым жа аўдыё - вы ўбачыце WER, колькасць сегментаў, этыкеткі дынамікаў і рэйтынгі даверу бок аб бок. Параўнанне Whisper Large V3 супраць Whisper Large V3 - гэта найбольш частае параўнанне.
Так. Вызначце "whisper-large-v3" як параметр мадэлі ў канечнай кропцы /v1/transcribe. Python і Node.js SDK ўключаюць прыклады Whisper Large V3. Бясплатны ўзровень API ўключае 100 хвілін / месяц.
Так. Паколькі Whisper Large V3 мае ліцэнзію MIT, вы можаце самастойна яго ўсталяваць. На старонцы адкрытага кода STT.ai паказаны рэпазітары і вагі праекту. Большасць каманд выкарыстаюць нашу ўсталяваную версію, каб прапусціць закупку GPU, абмен мадэлямі і аперацыі.