رونوشت با Whisper Large V3
4.2%
WER
99
زبانها
15.9x
سرعت
MIT
مجوز
در مورد Whisper Large V3
Whisper Large V3 پرچمدار مدل شناسایی گفتار متنباز OpenAI است. با ۱٫۵۵ میلیارد پارامتر، دقت فوقالعادهای را در ۹۹ زبان ارائه میدهد. از یک معماری کدگذار-رمزگشایی تبدیل استفاده میکند که بر روی ۶۸۰٬۰۰۰ ساعت دادههای صوتی چندزبانه آموزش دیده است.
اطلاعات مدل
- ارائهدهندهOpenAI
- معماری-
- مجوزMIT
- به روزرسانیAug 2026
پرسشهای متداول
STT.ai میزبان Whisper Large V3 در زیرساخت GPU ماست بنابراین میتوانید بدون فراهم کردن سختافزار خود از آن استفاده کنید - صدا یا ویدئو را بارگذاری کنید و Whisper Large V3 را از گزینش مدل انتخاب کنید.
On standard benchmarks, Whisper Large V3 achieves around 4.2% Word Error Rate. Real-world accuracy depends on audio quality, accent, and language; for noisy or accented recordings, expect a few percentage points higher WER.
Whisper Large V3 در لایه رایگان STT.ai اجرا میشود - هر بازدیدکننده ۶۰۰ دقیقه برای شروع بدون هزینه دریافت میکند.
Whisper Large V3 تحت MIT منتشر میشود، یک مجوز آزاد آزاد. شما میتوانید خودتان Whisper Large V3 را در سختافزار خود میزبانی کنید یا از نسخه میزبانی شده ما استفاده کنید - هر دو قابل استفاده تجاری هستند.
Whisper Large V3 از زبانهای 99 پشتیبانی میکند. تشخیص خودکار زبان درست را برای بیشتر صداها انتخاب میکند؛ همچنین میتوانید آن را برای یک بالا رفتن دقت کوچک دستی مشخص کنید.
Whisper Large V3 processes audio at about 15.9x real-time on our GPUs. A 1-hour audio file finishes in under 3 minutes; longer files queue and notify by email when done.
Whisper Large V3 has 1.55B parameters. Larger models tend to be more accurate but slower; STT.ai hosts Whisper Large V3 on GPU so the parameter count doesn't affect your client-side performance.
Whisper Large V3 هر فرمتی را که STT.ai پشتیبانی میکند را میپذیرد - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI و دیگران.
بله. نوشتار شنونده در کنار Whisper Large V3 برای هر رونوشت اجرا می شود — هر شنونده برچسب گذاری شده و می توانید بعداً آنها را در ویرایشگر تغییر نام دهید.
بله. Whisper Large V3 در محیط مدیریت شده ما اجرا میشود - صدا به صورت پیشفرض پردازش و حذف میشود و هیچگاه برای آموزش بدون انتخاب صریح استفاده نمیشود. برنامههای Pro رمزگذاری سمت مشتری را برای رونوشتهای در حال استراحت اضافه میکنند.
Use the compare-stt tool to run Whisper Large V3 against any other supported model on the same audio — you'll see WER, segment count, speaker labels, and confidence scores side-by-side. The Whisper Large V3 vs Whisper Large V3 comparison is the most commonly run.
بله. "whisper-large-v3" را به عنوان پارامتر مدل در /v1/transcribe endpoint مشخص کنید. Python و Node.js SDK شامل نمونههای Whisper Large V3 هستند. سطح API رایگان شامل ۱۰۰ دقیقه در ماه است.
بله. چون Whisper Large V3 دارای مجوز MIT است، شما میتوانید آن را خودتان میزبانی کنید. صفحهٔ منبع باز STT.ai فهرستی از پروژه و وزنها را ارائه میدهد. بیشتر تیمهای تولید از نسخهٔ میزبانی شده ما برای فراموش کردن خرید GPU، مبادلات مدل و عملیات استفاده میکنند.