Whisper Large V3
STT.ai runs this model on the paid tier. It is the model behind STT.ai Enhanced. Free transcription uses Whisper Large v3 Turbo, which is faster.
ప్రణాళికలను చూడండి →
·
విస్పర్ టుర్బోతో ఉచితంగా కలపడం →
4.2%
WER
99
భాషలుName
15.9x
వేగము
MIT
లైసెన్స్
గురించి Whisper Large V3
విస్పెర్ పెద్ద V3 ఓపెన్ AI యొక్క తెరచివున్న ప్రసంగపు గుర్తింపు నమూనా. 1.55 బిలియన్ రాతత, అది 99 భాషల్లో అసాధారణమైన ఖచ్చితత్వాన్ని అందిస్తుంది. ఇది ఒక బదిలీ ఆడియో డాటా 680 గంటలకు శిక్షణనిచ్చిన ఒక బదిలీ డిజైనర్ నిక్-డి-డినేటర్ భవనాన్ని ఉపయోగిస్తారు.
మోడల్ సమాచారంName
- సింద్దంచేయునదిOpenAI
- ముదురు ఆలివ్ పచ్చcolor-
- లైసెన్స్MIT
- నవీకరించబడిందిAug 2026
తరచుగా అడిగే ప్రశ్నలు
Whisper Large V3 is a speech-to-text model by OpenAI. STT.ai runs it on our own GPU for accounts on a paid plan, and it is the model behind the STT.ai Enhanced tier. Free transcription uses Whisper Large v3 Turbo, the faster checkpoint of the same family.
ప్రామాణిక బెంచ్మార్క్స్ లో Whisper Large V3 వర్సెస్ 4.2 శాతము పదకోశం తప్పు రేటు చుట్టూ వుంటోంది. నిజమైన- లోక ఖచ్చితత్వం ఆడియో నాణ్యత, ఉచ్చారణ, భాషపై ఆధారపడి ఉంటుంది. శృంగారింపు లేదా ఉద్దీపన రికార్డింగుల కోసం కొన్ని శాతం ఎక్కువ పాయింట్లు ఆశిస్తున్నాము.
Whisper Large V3 STT.ai యొక్క ఉచిత టైర్ న నడుస్తుంది ప్రతి సందర్శకులకు ఖర్చుతో ప్రారంభించడానికి 600 నిమిషాలు కావాలి. పాడ్ ప్రణాళికలు ఒక file పరిమితులు, వ్యక్తిగత అప్రమత్తత మరియు ప్రాధాన్యత క్రమం ఎక్కువ. ఒక i
MIT కింద Whisper Large V3 విడుదల చేయబడుతుంది. మీరు మీ సొంత హార్డ్వేర్ Whisper Large V3 లో స్వీయ - హోస్ట్ Whisper Large V3 చేయవచ్చు లేదా మా హోస్ట్ వెర్షన్ వెర్షన్ ఉపయోగించవచ్చు. రెండు ఉత్సుకంగాఅనుకూలంగా ఉంటాయి.
Whisper Large V3 భాషలు 99 భాషలకు మద్దతిస్తుంది. చాలా పెద్ద ఆడియో కొరకు సరైన భాషను స్వయంచాలకంగా తనిఖీ చేయవచ్చు; మీరు దీనిని ఒక చిన్న ఖచ్చిత వ్రైడ్ కోసం కూడా కేటాయించవచ్చు.
మా GPUS న 880x రియల్లేమ్ Whisper Large V3 ప్రక్రియల సమయంలో ఆడియో రియల్. ఒక 1- గంటల ఆడియో ఫైల్ ముగుస్తుంది 882 నిమిషాల క్రింద; ఎక్కువ దస్త్రాలు వరుసలో క్రమంలో మరియు ఈమెయిల్ ద్వారా తెలియజేయబడుతుంది.
Whisper Large V3 దగ్గర 8802 గణాంకాలు ఉంటాయి. పెద్ద మోడల్ మరింత ఖచ్చితమైనవి కానీ వేగం తక్కువగా ఉంటుంది. STT.ai హోస్ట్లు; GPU న 8Whisper Large V3 పై వుపతాణ కౌంట్ మీ క్లైంట్ యొక్క సౌలభ్యాను ప్రభావితం లేదు.
8801 ప్రతి ఫాధైర్య STT.ai మద్దతులను అంగీకరిస్తుంది — MP3, WAV, MAG, OGG4, MCV, MOV, MOV, వెబ్నో, AVI, మరియు ఇతర. అవుట్పుట్ TXT, SRT, DOT, DOT, DCX, JSX, JSC, లేదా PDF గా.
ఆ తర్వాత మీరు వాటిని పరిణామక్రమంలో రాసుకోవచ్చు.
Whisper Large V3 మన కృత్రిమ వాతావరణంలో నడుస్తుంది — ఆడియో అప్రమేయంగా ప్రక్రియ మరియు తీసివేయబడుతుంది మరియు ఎటువంటి విస్తీర్ణత లేకుండా శిక్షణ కోసం ఎప్పుడూ. ప్రోగ్రాంలు రికేషన్స్ కోసం క్లైంట్- వైపు నినాప్ చేర్చండి.
అదే ఆడియోనందు మ్యాచ్డ్డ్ Whisper Large V3 మ్యాచ్డ్ను నడుపుటకు పోల్చు-tt ఉపకరణాన్ని వుపయోగించుము — మీరు WER, భాగపు కౌంటీ కౌంటర్, స్పీకర్ లేబుల్స్, మరియు నమ్మదగ్గ స్కోర్లను ప్రక్కకు చూస్తారు. Whisper Large V3 vs Whisper v1 పెద్ద V3 పోల్చు సర్వసాధారణంగా నడుపుతుంది.
Yes, on a paid plan. Specify "whisper-large-v3" as the model parameter on the /v1/transcribe endpoint. Keys without an active plan are served Whisper Large v3 Turbo instead. The request still succeeds; it just runs the free model.
Whisper Large V3 ఉంది ఎందుకంటే MIT-licented ఉంది, మీరు స్వీయ-పోర్టర్లను చేయవచ్చు STT.ai యొక్క ఓపెన్ పేజీ ప్రాజెక్టు repo మరియు బరువులను జాబితాలో ఉంది. చాలా ఉత్పత్తి బృందం GPU బృందం GPU బృందం, మాదిరి బదిలీలు మరియు ops కోసం మా వుడ్ వెర్షన్ వెర్షన్ ఉపయోగిస్తారు.