Whisper Large V3

STT.ai اس ماڈل کو ادا کئے گئے سطح پر چلاتا ہے یہ STT.ai Enhanced کے پیچھے ماڈل ہے مفت نقل Whisper Large v3 Turbo استعمال کرتا ہے، جو تیز ہے منصوبے دیکھو → · Whisper Turbo کے ساتھ مفت نقل →
4.2%
WER
99
زبانیں
15.9x
رفتار
MIT
لائسنس

متعلقہ Whisper Large V3

ويسپر ليڈر V3 اوپن اي اي کا پرچم دار اوپن سورس اسپيچ رڪنيکيشن ماڈل هے 1.55 ارب پارا مٹرز کے ساتھ ، یہ 99 زبانوں میں غير معمولي دقت پيش کر تا هے ۔ یہ 680،000 گھنٹوں کے متعدد زبانوں کے اوڈيو ڈیٹا پر تربيت دئے گئے ٹرانزفورمر انکوڈر-ڈيکوڈر آرکٹیکٹچر کا استعمال کرتا هے ۔
ماڈل معلومات
  • فراہم کُنندہOpenAI
  • فن تعمير-
  • لائسنسMIT
  • اپڈیٹAug 2026

عام سوالات

Whisper Large V3 OpenAI کے ذريعے ایک حديث سے متن تک ماڈل هے STT.ai اس کو ہمارے خودي GPU پر ادا کرتا هے اور STT.ai Enhanced Tier کے پيچھے ماڈل هے مفت نقل Whisper Large v3 Turbo کو استعمال کرتا هے ، اسی خاندان کے تيزي سے چک پو ئنٹ

معیاری معیاروں پر، Whisper Large V3 4.2% ورڈ ایرر ریٹ حاصل کرتا ہے. حقیقی دنیا میں دقت آڈیو کی کیفیت، لہجہ اور زبان پر منحصر ہے؛ شوردار یا لہجہ والی ریکارڈنگ کے لیے، چند فیصد پوائنٹوں کی توقع کریں WER زیادہ.

Whisper Large V3 STT.ai کے مفت سطح پر چلتا ہے - ہر مہمان کو 600 منٹ ملتے ہیں بغیر کسی خرچ کے شروع کرنے کے لئے. ادا کردہ منصوبے پر فائیل زیادہ حدیں، نجی نقل، اور ترجیح قطار لگانا شامل کرتے ہیں.

Whisper Large V3 کو MIT کے تحت آزاد کیا گیا ہے، ایک اجازت دار اوپن سورس لائسنس. آپ اپنے ہیڈریڈر پر خود-ہسٹ Whisper Large V3 استعمال کرسکتے ہیں یا ہماری مہمانداری ورژن استعمال کرسکتے ہیں - دونوں تجارتی طور پر استعمال کی جاسکتے ہیں.

Whisper Large V3 99 زبانوں کو مدد دیتا ہے. خودکار دریافت زیادہ تر آڈیوز کے لیے صحیح زبان کو منتخب کرتا ہے؛ آپ اسے چھوٹے صحیح لیفت کے لیے ہاتھ سے بھی بیان کرسکتے ہیں.

Whisper Large V3 ہمارے GPUs پر 15.9x ریئل ٹائم پر آڈیو پروسیسنگ کرتا ہے. ایک 1 گھنٹہ آڈیو فائل 3 منٹ میں ختم ہوتی ہے؛ لمبی فائل کی قطار اور جب ختم ہو جائے تو ای میل کے ذریعے اطلاع دی جائے گی.

Whisper Large V3 ميں 1.55B پارا مڈل هے. بڑ ماڈل زیادہ صحيح هے مگر سست هے STT.ai GPU پر Whisper Large V3 ميزبان هے اس ليے پارا مڈل شماري آپکے کلائنٹ سا يد پرفارمنس کو متاثر نہیں کر تا

Whisper Large V3 ہر فارمیٹ قبول کرتا ہے جو STT.ai حمایت کرتا ہے - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, اور باقی. TXT, SRT, VTT, DOCX, JSON, or PDF کے طور پر خروجی.

ہاں۔ ہر نقل کے لئے Whisper Large V3 کے ساتھ ساتھ اسپیکر ڈائریزیشن چلتا ہے۔ ہر اسپیکر کو لیبل دیا جاتا ہے اور آپ بعد میں ایڈیٹر میں ان کا نام بدل سکتے ہیں۔

ہاں. Whisper Large V3 ہمارے انتظامی ماحول میں چلتا ہے - آڈیو کو پروسیسنگ اور ڈیفالٹ کے طور پر حذف کیا جاتا ہے اور واضح آپٹ-ان کے بغیر تربیت کے لئے کبھی استعمال نہیں کیا جاتا. پرو منصوبے آرام میں نقل کے لئے کلائنٹ-سایڈ انکریفٹنگ شامل کرتے ہیں.

Whisper Large V3 کو ایک ہی آڈیو پر کسی بھی دوسرے مدد شدہ ماڈل کے خلاف چلانے کے لیے comparison-stt ٹول استعمال کریں - آپ WER، سگمنٹ گنتی، اسپیکر لیبلز، اور اعتماد کے سکور دیکھیں گے. Whisper Large V3 vs Whisper Large V3 موازنہ سب سے عام چلتا ہے.

ہاں، ایک ادا کیے گئے پلان پر. /v1/transcribe انتہا نقطہ پر ماڈل پیرامیٹر کے طور پر "whisper-large-v3" کو بیان کریں. کیز بغیر ایک فعال پلان کے بدلے Whisper Large v3 Turbo سروس کی جاتی ہے. درخواست اب بھی کامیاب ہے؛ یہ صرف مفت ماڈل چلاتا ہے.

جی ہاں. کیونکہ Whisper Large V3 MIT لائسنس ہے، آپ اسے خود مہمان بنا سکتے ہیں. STT.ai کے اوپن سورس صفحے پر پروجیکٹ ریپو اور وزن کی فہرست ہے. زیادہ تر پروڈکشن ٹیم GPU کی فراہمی کو چھوڑنے کے ليے ہمارے مہمانہ ورژن کا استعمال کرتے هے، ماڈل سواپ اور آپس.