SenseVoice
STT.ai اس ماڈل کو نہیں چلاتا. یہ صفحہ اس کے بارے میں حوالہ معلومات ہے.
ہم چلتے ہیں کہ ماڈل کے ساتھ نقل →
5.5%
WER
50
زبانیں
50.0x
رفتار
MIT
لائسنس
متعلقہ SenseVoice
SenseVoice FunAudioLLM سے ایک زباني بنياد ماڈل هے جو نقل سے آگے جاتا هے اس ميں 50+ زبانوں کا حامي هے اور اس ميں احساسي شناخت ، آ ڈیو ايجنٹ کٹ کٹ اور يک واحد ماڈل ميں متني عادي کر نے کے ليے قابليتیں شامل هے
ماڈل معلومات
- فراہم کُنندہFunAudioLLM
- فن تعمير-
- لائسنسMIT
- اپڈیٹMar 2026
عام سوالات
SenseVoice FunAudioLLMکے ذريعے وائيں سے متن ميں تبديل کر نے والا ماڈل هے STT.ai حاليں SenseVoice کو چلتا هيں نهيں - هي صفحہ ماڈل کے متعلق معلومات کي حوالہ هے STT.ai پر نقل کر نے کے ليے ماڈل پيليچر Whisper خاندان پيش کرتا هے (Turbo ، Large V3 ، Medium ، Small)
معیاری معیاروں پر، SenseVoice 5.5% ورڈ ایرر ریٹ حاصل کرتا ہے. حقیقی دنیا میں دقت آڈیو کی کیفیت، لہجہ اور زبان پر منحصر ہے؛ شوردار یا لہجہ والی ریکارڈنگ کے لیے، چند فیصد پوائنٹوں کی توقع کریں WER زیادہ.
SenseVoice STT.ai پر دستیاب نہیں ہے اسکے اپنے لائسنس کے شرطوں کو آپ خود چلنے کے لئے انتظام کرتے ہیں STT.ai کے مفت سطح کو ہم Whisper ماڈل چلتے ہیں کو ڈھانپتا ہے - شروع کرنے کے ليے 600 منٹ، پھر ماہانہ مفت اوپر
SenseVoice کو MIT کے تحت آزاد کیا گیا ہے، ایک اجازت دار اوپن سورس لائسنس. آپ اپنے ہیڈریڈر پر خود-ہسٹ SenseVoice استعمال کرسکتے ہیں یا ہماری مہمانداری ورژن استعمال کرسکتے ہیں - دونوں تجارتی طور پر استعمال کی جاسکتے ہیں.
SenseVoice 50 زبانوں کو مدد دیتا ہے. خودکار دریافت زیادہ تر آڈیوز کے لیے صحیح زبان کو منتخب کرتا ہے؛ آپ اسے چھوٹے صحیح لیفت کے لیے ہاتھ سے بھی بیان کرسکتے ہیں.
SenseVoice ہمارے GPUs پر 50.0x ریئل ٹائم پر آڈیو پروسیسنگ کرتا ہے. ایک 1 گھنٹہ آڈیو فائل 1 منٹ میں ختم ہوتی ہے؛ لمبی فائل کی قطار اور جب ختم ہو جائے تو ای میل کے ذریعے اطلاع دی جائے گی.
SenseVoice ميں 234M پارا مڈل هے. بڑ ماڈل زیادہ صحيح هے مگر سست هے STT.ai GPU پر SenseVoice ميزبان هے اس ليے پارا مڈل شماري آپکے کلائنٹ سا يد پرفارمنس کو متاثر نہیں کر تا
SenseVoice ہر فارمیٹ قبول کرتا ہے جو STT.ai حمایت کرتا ہے - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, اور باقی. TXT, SRT, VTT, DOCX, JSON, or PDF کے طور پر خروجی.
ہاں۔ ہر نقل کے لئے SenseVoice کے ساتھ ساتھ اسپیکر ڈائریزیشن چلتا ہے۔ ہر اسپیکر کو لیبل دیا جاتا ہے اور آپ بعد میں ایڈیٹر میں ان کا نام بدل سکتے ہیں۔
ہاں. SenseVoice ہمارے انتظامی ماحول میں چلتا ہے - آڈیو کو پروسیسنگ اور ڈیفالٹ کے طور پر حذف کیا جاتا ہے اور واضح آپٹ-ان کے بغیر تربیت کے لئے کبھی استعمال نہیں کیا جاتا. پرو منصوبے آرام میں نقل کے لئے کلائنٹ-سایڈ انکریفٹنگ شامل کرتے ہیں.
SenseVoice کو ایک ہی آڈیو پر کسی بھی دوسرے مدد شدہ ماڈل کے خلاف چلانے کے لیے comparison-stt ٹول استعمال کریں - آپ WER، سگمنٹ گنتی، اسپیکر لیبلز، اور اعتماد کے سکور دیکھیں گے. SenseVoice vs Whisper Large V3 موازنہ سب سے عام چلتا ہے.
جی ہاں. /v1/transcribe انتہا پوائنٹ پر ماڈل پیرامیٹر کے طور پر "sensevoice" کو بیان کریں. Python اور Node.js SDKs میں SenseVoice مثالیں شامل ہیں. مفت API سطح میں 100 منٹ/مہینت شامل ہیں.
جی ہاں. کیونکہ SenseVoice MIT لائسنس ہے، آپ اسے خود مہمان بنا سکتے ہیں. STT.ai کے اوپن سورس صفحے پر پروجیکٹ ریپو اور وزن کی فہرست ہے. زیادہ تر پروڈکشن ٹیم GPU کی فراہمی کو چھوڑنے کے ليے ہمارے مہمانہ ورژن کا استعمال کرتے هے، ماڈل سواپ اور آپس.