Transcribe with Whisper Large V3
4.2%
WER
99
Languages
8.0x
Speed
MIT
License
About Whisper Large V3
Model Info
- ProviderOpenAI
- Architecture-
- LicenseMIT
- UpdatedMar 2026
Usein kysyttyjä kysymyksiä
Whisper Large V3 on OpenAI:n puheesta tekstiin -malli. STT.ai isännöi Whisper Large V3:ta GPU-infrastruktuurissamme, joten voit käyttää sitä ilman, että varaat omia laitteitasi – lataat äänen tai videon ja valitset Whisper Large V3 mallinnostolaitteesta.
Standardimittauksissa Whisper Large V3 saavuttaa noin 8801 prosentin Word Error Rate -arvon. Todellisen maailman tarkkuus riippuu äänenlaadusta, aksentista ja kielestä; äänekkäiden tai korostuneiden äänitteiden osalta WER:n odotetaan olevan muutaman prosenttiyksikön korkeampi.
Whisper Large V3 kulkee STT.ai:n ilmaisella kerroksella – jokainen kävijä saa 600 minuuttia kuukaudessa maksutta. Maksettuihin suunnitelmiin lisätään pidempiä tiedostokohtaisia raja-arvoja, yksityisiä selostuksia ja ensisijaisuusjonoa.
Whisper Large V3 julkaistaan sallivan avoimen lähdekoodin lisenssin alla. Voit itse isännöidä Whisper Large V3:ta omalla laitteistollasi tai käyttää isäntäversiotamme – molemmat ovat kaupallisesti käyttökelpoisia.
Whisper Large V3 tukee 99 kieltä. Automaattinen havainnointi valitsee oikean kielen useimmille äänille; voit myös määrittää sen manuaalisesti pientä tarkkuusnosturia varten.
Whisper Large V3 prosessorin äänentoisto noin 8.0x reaaliaikaisesti GPU:issa. Tunnin äänitiedosto valmistuu alle 7 minuutissa, pidempi tiedostojono ja ilmoitus sähköpostitse, kun se on tehty.
Whisper Large V3:ssa on 1.55B parametria. Suuremmat mallit ovat yleensä tarkempia, mutta hitaampia; STT.ai isännöi Whisper Large V3:a GPU:ssa, joten parametrien määrä ei vaikuta asiakaspuolen suorituskykyyn.
Whisper Large V3 hyväksyy jokaisen formaatin STT.ai tukea: MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI ja muut. Tuotos on TXT, SRT, VTT, DOCX, JSON tai PDF.
Kyllä. Kaiuttimen diarisointi kulkee Whisper Large V3:n rinnalla jokaista transkriptiota kohden – jokainen puhuja on merkitty, ja voit nimetä sen myöhemmin uudelleen päätoimittajaksi.
Kyllä. Whisper Large V3 kulkee hallitussa ympäristössämme – ääntä käsitellään ja poistetaan oletuksena, eikä sitä koskaan käytetä harjoitteluun ilman nimenomaista opt-iniä. Pro suunnittelee lisäävänsä asiakaspuolen salauksen selostuksiin levossa.
Verrattuna ensimmäiseen työkaluun voit ajaa Whisper Large V3 muuta saman äänen avulla tuettua mallia vastaan – näet WER:n, segmentin, kaiuttimen tarroja ja itseluottamuspisteitä vierekkäin. Whisper Large V3 vs. Whisper Large V3 -vertailu on yleisin.
Kyllä. Määrittele "whisper-large-v3" mallimuuttujaksi /v1/transcribe-päätetapahtumassa. Python ja Node.js SDKs sisältävät Whisper Large V3 esimerkkiä. Vapaa API-taso sisältää 100 minuuttia kuukaudessa.
Kyllä. Koska Whisper Large V3 on MIT-lisensoitu, voit itse isännöidä sitä. STT.ai:n avoimen lähdekoodin sivulla on listattu projektin repo ja painot. Useimmat tuotantoryhmät käyttävät isäntäversiotamme jättääkseen GPU-hankinnat, mallivaihdot ja opsit väliin.