Transcribe with Whisper Large V3
4.2%
WER
99
Languages
8.0x
Speed
MIT
License
About Whisper Large V3
Model Info
- ProviderOpenAI
- Architecture-
- LicenseMIT
- UpdatedMar 2026
Pyetje të shpeshta
Whisper Large V3 është një model i fjalës në tekst nga OpenAI. STT.ai mban Whisper Large V3 në infrastrukturën tonë të GPU kështu që mund ta përdorni pa furnizuar hardware-in tuaj — ngarkoni audion ose videon dhe zgjidhni Whisper Large V3 nga zgjedhësi i modelit.
Në standartet e vlerësimit, Whisper Large V3 arrin rreth 4.2% të normave të gabimeve të fjalëve. Saktësia në botën reale varet nga cilësia e audios, theksi dhe gjuha; për regjistrime me zhurmë ose theks, prit disa përqindje më të larta WER.
Whisper Large V3 punon në nivelin e lirë të STT.ai — çdo vizitor merr 600 minuta në muaj pa kosto. Planet e paguar shtojnë kufizime më të gjata për file, transkripta private dhe renditje në radhë me përparësi.
Whisper Large V3 është lëshuar nën MIT, një licencë e hapur e hapur. Mund të vetë-hostoni Whisper Large V3 në hardware-in tuaj ose të përdorni versionin tonë të pritur — të dy janë komercialisht të përdorshëm.
Whisper Large V3 suporton 99 gjuhë. Zbulimi automatik zgjedh gjuhën e duhur për shumicën e audiove; mund ta specifikoni gjithashtu manualisht për një rritje të vogël të saktësisë.
Whisper Large V3 përpunon audion në rreth 8.0x në kohë reale në GPU-të tona. Një file audio 1 orë përfundon në më pak se 7 minuta; file më të gjatë vënë në radhë dhe njoftohen me email kur përfundojnë.
Whisper Large V3 ka parametrat 1.55B. Modelet më të mëdha priren të jenë më të sakta por më të ngadalshme; STT.ai hosts Whisper Large V3 në GPU kështu që numërimi i parametrave nuk ndikon në performancën e anës së klientit.
Whisper Large V3 pranon çdo format që suporton STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, dhe të tjerë. Shfaq si TXT, SRT, VTT, DOCX, JSON, ose PDF.
Po. Diarization e folësit punon së bashku me Whisper Large V3 për çdo transkriptim - çdo folës është i etiketuar dhe mund t'i riemërtoni ata në editor më pas.
Po. Whisper Large V3 punon në mjedisin tonë të menazhuar — audiot përpunohen dhe eleminohen në mënyrë të prezgjedhur dhe nuk përdoren kurrë për trainim pa opsion të hapur. Planet Pro shtojnë kriptimin në anën e klientit për transkriptat në pushim.
Përdor instrumentin compare-stt për të ekzekutuar Whisper Large V3 kundër çdo modeli tjetër të suportuar në të njëjtin audio — do të shihni WER, numrin e segmenteve, etiketat e folësve dhe rezultatet e besimit krah-për-krah. Krahasimi Whisper Large V3 vs Whisper Large V3 është më i zakonshmi.
Po. Specifiko "whisper-large-v3" si parametri i modelit në /v1/transcribe endpoint. Python dhe Node.js SDK përfshijnë shembuj Whisper Large V3. Niveli i API pa pagesë përfshin 100 minuta në muaj.
Po. Sepse Whisper Large V3 është i licencuar MIT, mund ta hostosh vetë. Faqja e burimit të hapur të STT.ai-ës përmban listën e projektit dhe peshat. Shumica e ekipeve të prodhimit përdorin versionin tonë të pritur për të kaluar GPU-në, modelin e shkëmbimit dhe operacionet.