Ingeskryf met Whisper Large V3

Werke met beskikbare oudio-video. DRM-beskermde inhoud word nie ondersteun nie.

Gradeer op vir Verbetering
Privaat transkripsie
Gesels met transkripsie
Ontsluit met pro →
Laat val lêer hier of kliek na blaai
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM 4A tot 2GB
Gradeer op vir Verbetering
Privaat transkripsie
Gesels met transkripsie
Ontsluit met pro →
Gradeer op vir Verbetering
Neem tans op: 0:00
@ info: whatsthis Vosk (instant)
Verbeterde Fluister (juiste)
Openbare skakels: 24h, teks slegs · Teken op vir 7d + oudio · Pro vir private skakels

Ware-tyd spraak vir teks. K- outo-korress wanneer jy praat ooit- akkuraatheid verbeter met langer spraak.

Toets eers jou mikrofoon
❤️ Love STT.ai? Tell your friends!
Jy het jou gratis transkripsie gebruik

Teken vir vryheid op om 600 minute te kry, of op te skakel van R110/maand vir nog duisende.

10 vry min/dag 600 min vry met opteken Geen kredietkaart nie Geënkripteer
Teken gratis op →
4.2%
WER
99
Tale
15.9x
Spoed
MIT
Lisensie

Aangaande Whisper Large V3

Whisper Groot V3 is OpenAI se vlagskip oop-onsource se spraak erkenning model. Met 1,55 miljard parameters bied dit uitsonderlike akkuraatheid oor 99 tale. Dit gebruik 'n transformator enkodeerder argitektuur wat opgelei is op 680 000 uur van veeltalige oudio data.

Vrae wat dikwels gevra word

Whisper Large V3 is 'n spraak-na-teksmodel met OpenAI. STT.ai gashere van ons GPU-fu-U-fustrasie sodat jy dit kan gebruik sonder om jou eie hardeware te verskaf ooit klank of video op te laai en Whisper Large V3 van die modelpikkel te kies.

Op standaard bankmerke bereik Whisper Large V3 om 4.2% Woord Fout tempo. Real-world akkuraatheid hang af van klankgehalte, aksent en taal; vir lawaaierige of gefluurde opnames, verwag 'n paar persentasie punte hoër WER.

Whisper Large V3 loop op STT.ai se vry vlak ooit ooit meer as 600 minute om te begin teen geen koste nie. Paid planne voeg langer per-lêer perke by, private transkripsies en prioriteit wagtoue.

Whisper Large V3 word vrygestel onder MIT, 'n permissiewe open-onse lisensie. Jy kan self-host Whisper Large V3 op jou eie hardeware of gebruik ons gegasheer weergawe 2 is kommersieel bruikbaar.

Whisper Large V3 ondersteun 99 tale. Outo-speur die regte taal vir die meeste oudio; u kan dit ook self spesifiseer vir 'n klein akkuraatheid.

Whisper Large V3 verwerk klank oor ongeveer 15.9x real-time op ons GPUs. 'n 1-hour klank lêer eindig onder 3 minute; langer lêers wag en inkennis stel deur e-pos wanneer dit gedoen word.

Whisper Large V3 het 1.55B parameters. Groter modelle is geneig om akkurater maar stadiger te wees; STT.ai-gashere Whisper Large V3 op GPU sodat die parametertelling nie jou kliënt-side-prestasie beïnvloed nie.

Whisper Large V3 accepts every format STT.ai supports — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, and others. Output as TXT, SRT, VTT, DOCX, JSON, or PDF.

Ja, Speaker diarisering loop langs Whisper Large V3 vir elke transkripsie ium ium word elke spreker gemerk en jy kan hulle na die volgende in die redigeerder hernoem.

Ja. Whisper Large V3 loop in ons bestuurde omgewing Lazlo-oudio word verwerk en uitgevee deur verstek en nooit gebruik vir opleiding sonder eksplisiete opt-in nie. Pro planne voeg kliënt-side enkripsie vir transkripsies op res.

Gebruik die vergelyk-stel gereedskap om Whisper Large V3 te laat loop teen enige ander ondersteunde model op dieselfde oudio DVD jy sal sien WER, segment tel, luidspreker etikette en vertroue punte kant- by-side. die Whisper Large V3 vs Whift Groot V3 vergelyking is die algemeenste hardloop.

Ja. Spesifiseer "whisper-large-v3" as die model parameter op die /v1/aanteken eindepunt. Python en Node.js SDKs sluit 8800 voorbeelde in. Vry 'nPI-vlak sluit 100 minute/month in.

Ja. Omdat Whisper Large V3 MIT-licensed is, kan jy self-host dit. STT.ai se ope-bou-blad gee 'n lys van die projek repo en gewigte. Mees produksiespanne gebruik ons gemoÃ" weergawe om GPU-berigting, model ruilinge en eeps te laat vaar.
Made by @nadermx