Whisper Large V3
STT.ai runs this model on the paid tier. It is the model behind STT.ai Enhanced. Free transcription uses Whisper Large v3 Turbo, which is faster.
ತಂತ್ರಾಂಶಗಳನ್ನು ನೋಡಿ →
·
ವೀಸ್ಪರ್ಟ್ರೊಬೋ ಜೊತೆ ಬಿಡುಗಡೆ →
4.2%
WER
99
ಭಾಷೆಗಳುName
15.9x
ವೇಗ
MIT
ಪರವಾನಗಿ
ಕುರಿತು Whisper Large V3
Visper ದೊಡ್ಡ V3 ಓಪನ್ ವಿ3 ರ ವರ್ಗಾವಣೆ ವಾಚಕದ ಅನುವಾದದ ಮಾದರಿ. ೧.100 ಕೋಟಿ ಪ್ರತಿಗಳು, ಅದು 99 ಭಾಷೆಗಳಲ್ಲಿ ಅಸಾಧಾರಣವಾದ ನಿಷ್ಕೃಷ್ಟತೆಯನ್ನು ಒದಗಿಸುತ್ತದೆ. ಇದು ಬಹುಭಾಷೀಯ ಆಡಿಯೊ ದತ್ತಾಂಶದಲ್ಲಿ 6 80,000 ಗಂಟೆಗಳನ್ನು ತರಬೇತಿಗೊಳಿಸಿದ ರೂಪಾಂತರ ಗೂಢಲಿಪಕ ನಿರ್ದೇಶಕ ಸಂಖ್ಯಾ ಕಟ್ಟಡವನ್ನು ಬಳಸುತ್ತದೆ.
ಭಾಷೆಗಳ ಬೆಂಬಲ Whisper Large V3
ಮಾದರಿ ಮಾಹಿತಿName
- ಪೂರೈಕೆದಾರ (provider)OpenAI
- ವಿಸ್ತರಣಾ (ಕ್ಯಾಸಲ್) Name-
- ಪರವಾನಗಿMIT
- ಅಪ್ಡೇಟ್ ಮಾಡಲಾಗಿದೆAug 2026
ಪದೇ ಪದೇ ಕೇಳುವ ಪ್ರಶ್ನೆಗಳು
Whisper Large V3 is a speech-to-text model by OpenAI. STT.ai runs it on our own GPU for accounts on a paid plan, and it is the model behind the STT.ai Enhanced tier. Free transcription uses Whisper Large v3 Turbo, the faster checkpoint of the same family.
On standard benchmarks, Whisper Large V3 achieves around 4.2% Word Error Rate. Real-world accuracy depends on audio quality, accent, and language; for noisy or accented recordings, expect a few percentage points higher WER.
Whisper Large V3 STT.ai ನ ಮುಕ್ತ ಹಾರ್ಡ್ನ ಮೇಲೆ ಚಲಾಯಿಸುತ್ತದೆ. ಪ್ರತಿ ಸಂದರ್ಶಕನಿಗೂ ಯಾವುದೇ ಬೆಲೆಯನ್ನು ಆರಂಭಿಸಲು 600 ನಿಮಿಷಗಳಷ್ಟಾಗುತ್ತದೆ. ಪೈಡ್ ಯೋಜನೆಗಳು ಒಂದು file ಮಿತಿ, ಖಾಸಗಿ ರೋಚಕಗಳು ಮತ್ತು ಆದ್ಯತೆಯ ಕ್ರಮವನ್ನು ಹೆಚ್ಚಿಸುತ್ತವೆ. ಮತ್ತು ಇದು ಒಂದು ವೇಳೆ ನಾವು ಒಂದು ರೋಚಕ ಪ್ಲೇಯರ್ ಅನ್ನು ಹುಡುಕಲು ಪ್ರಾರಂಭಿಸುತ್ತೇವೆ. ಒಂದು ಪ್ಲೇಯರ್ ಪ್ಲಾಸ್ ಎಂದು ನೀವು ನಿಮ್ಮ ಪ್ರೊಗ್ರಾಮ್ ಅನ್ನು ಒಂದು ವೇಳೆ ನಿಮ್ಮ ಪ್ರೆಸ್ ಮಾಡಲು ಬಯಸುತ್ತೀರಾ? ಒಂದು ವೇಳೆ, ಒಂದು ವೇಳೆ, ಇದು ಒಂದು ವೇಳೆ, ಒಂದು ವೇಳೆ, ಒಂದು ವೇಳೆ, ಒಂದು ವೇಳೆ, ಒಂದು ರೂಮ್ ಅನ್ನು ಒಂದು ರೂಮ್ ನಲ್ಲಿ, ಮತ್ತು ಒಂದು ವೇಳೆ, ಒಂದು ವೇಳೆ, ಒಂದು ಪ್ಲೇಟ್ ಪ್ಲೇಟ್ ಅಕೇಡ್ ಎಂದು ನೀವು ನಿಮ್ಮ ಪ್ರೊಗ್ರಾಭ್ಯುತ್ವದಲ್ಲಿ, ನೀವು ಒಂದು ಹೊಸ ಪ್ರೊಫೈಲಕವನ್ನು ಪ್ರಾರಂಭಿಸಿದರೆ, ನೀವು ಒಂದು ಪ್ಲೇಡ್ ಪ್ಲೇಡ್ ಪ್ಲೇಟ್ ಅನ್ನು, ಮತ್ತು ನೀವು ಒಂದು ಪ್ಲೇಟ್ ಪ್ಲೇಟ್ ಅನ್ನು, ಮತ್ತು ಒಂದು ಹೊಸ ನಿತ್ರಿ, ಇದು ನಿಮ್ಮ ಪ್ರಶುದ ಗದ್ದು ಆಗಿರುತ್ತದೆ.
Whisper Large V3 ಯು ೮೦ ಮುದ್ರಿತ, ಒಂದು ರಕ್ಷಾ ಮುಕ್ತ-ಸಂಸ್ಕಾರ ಲೈಸನ್ಸ್ ಅನ್ನು ಬಿಡುಗಡೆ ಮಾಡಲಾಗಿದೆ. ನೀವು ನಿಮ್ಮ ಸ್ವಂತ ಯಂತ್ರದ ಮೂಲಕ ಸ್ವ-host Whisper Large V3 ನೀಡಬಹುದು ಅಥವಾ ನಮ್ಮ host ಆವೃತ್ತಿಯನ್ನು ಬಳಸಬಹುದು. ಎರಡೂ ಬಳಕೆಗಳು ವಾಣಿಜ್ಯಾರ್ಥವಾಗಿ ಆಗುತ್ತವೆ.
Whisper Large V3 ಭಾಷೆಗಳು 99 ಭಾಷೆಗಳನ್ನು ಬೆಂಬಲಿಸುತ್ತದೆ. ಹೆಚ್ಚಿನ ಆಡಿಯೊಕ್ಕಾಗಿ ಸರಿಯಾದ ಭಾಷೆಯನ್ನು ಆರಿಸುವುದು; ಒಂದು ಚಿಕ್ಕ ಚುಕ್ಕಿ ತೆರಳುವಿಕೆಗಾಗಿ ಇದನ್ನು ಕೈಯಾರೆ ಸೂಚಿಸಬಹುದಾಗಿದೆ.
Whisper Large V3 ಪ್ರಕ್ರಿಯೆಗಳು ನಮ್ಮ GPUS ನಲ್ಲಿ ಆಡಿಯೊ ರಿಯಲ್ಟೈಮ್ ರಿಯಲ್ ಸಮಯ. ಒಂದು ೧- ಗಂಟೆ ಆಡಿಯೋ ಕಡತವು 8802 ನಿಮಿಷಗಳ ಕೆಳಗಿದೆ; ಉದ್ದವಾದ ಕಡತಗಳು ಅನುಕ್ರಮವಾಗಿ ಮುಗಿಸಲ್ಪಡುತ್ತವೆ ಹಾಗು ಇ- ಅಂಚೆ ಮೂಲಕ ಮಾಹಿತಿಯನ್ನು ಒದಗಿಸುತ್ತವೆ.
Whisper Large V3 has 1.55B parameters. Larger models tend to be more accurate but slower; STT.ai hosts Whisper Large V3 on GPU so the parameter count doesn't affect your client-side performance.
Whisper Large V3 accepts every format STT.ai supports — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, and others. Output as TXT, SRT, VTT, DOCX, JSON, or PDF.
ಹೌದು, ಭಾಷಣಕರ್ತರು ಪ್ರತಿ ಅಕ್ಷರಮಾಲೆಯಲ್ಲಿ Whisper Large V3ಕ್ಕೂ ಹೆಚ್ಚು ವೇಗವಾಗಿ ಓಡುತ್ತಾರೆ.
ಹೌದು. Whisper Large V3 ನಮ್ಮ ಸಮರ್ಥವಾದ ಪರಿಸರದಲ್ಲಿ ಚಲನೆಗೊಂಡಿದೆ. ಆಡಿಯೊವನ್ನು ಪೂರ್ವನಿಯೋಜಿತವಾಗಿ ಸಂಸ್ಕರಿಸಲಾಗಿದೆ ಹಾಗು ಅಳಿಸಲಾಗಿದೆ ಮತ್ತು ಯಾವುದೇ ಸ್ಪಷ್ಟವಾದ ಆಪ್ಲೆಟ್- incent ತರಬೇತಿಯನ್ನು ಬಳಸುವುದಿಲ್ಲ. ಪ್ರೋಗ್ರಾಂನಲ್ಲಿ ಫೆಡರಿಟ್-ಭಾಗದ ಗೂಢಲಿಪೀಕರಣವನ್ನು ಸೇರಿಸಿ.
Whisper Large V3 ಪ್ರತಿಬಿಂಬಿತ (ಆಡಿಯೋ) ಮಾದರಿಗೆ ವಿರುದ್ಧವಾದ Whisper Large V3 ಅನ್ನು ಚಲಾಯಿಸಲು ಬಳಸಿ. ನೀವು WER, ಭಾಗದ ಲೆಕ್ಕ, ಭಾಷಣಕಾರಕ ಗುರುತು, ಮತ್ತು ದೃಢಭರವಸೆಯ ಬದಿಯಲ್ಲಿ ಗುರುತುಗಳನ್ನು ಕಾಣುವಿರಿ. Whisper Large V3 ವಿಸ್ಪರ್ ವಿಸ್ಪರ್ ದೊಡ್ಡ ವಿಸ್ಪರ್ ವಿ೩ ನ ತುಣುಕುಗಳು ಹೆಚ್ಚಾಗಿ ಚಾಲನೆಗೊಳ್ಳುತ್ತಿದೆ.
Yes, on a paid plan. Specify "whisper-large-v3" as the model parameter on the /v1/transcribe endpoint. Keys without an active plan are served Whisper Large v3 Turbo instead. The request still succeeds; it just runs the free model.
೮೮೦೧ ಎಂದರೆ MIT-ಅಂಕಿಯ ವರ್ಗಾವಣೆ ಆಗಿರುವುದರಿಂದ, ನೀವು ಸ್ವಪ್ರಯೋಜನೆ ಮಾಡಲು ಸಾಧ್ಯವಾಗುತ್ತದೆ. STT.aiರ ತೆರೆದ ಲೇಬಲ್ ಪುಟ ರೀಪಾ ಹಾಗು ಭಾರಗಳ ಪಟ್ಟಿ. ಹೆಚ್ಚಿನ ಉತ್ಪಾದನಾ ತಂಡಗಳು GPU ಔಟ್ವರ್ಕ್, ಮಾದರಿ ಸ್ಯಾಪ್ಸ್ ಮತ್ತು ops ಅನ್ನು ಕೆಳಕ್ಕೆ ಎಳೆದುಕೊಳ್ಳಲು ನಮ್ಮ ಹವ್ಯಾಸದ ಆವೃತ್ತಿಯನ್ನು ಬಳಸುತ್ತವೆ.