SenseVoice

STT.ai does not run this model. This page is reference information about it. हम जो मॉडल चलाते हैं के साथ एहसान एहसान पत्र →
5.5%
WER
50
भाषाएँ
50.0x
गति
MIT
लाइसेंस

के बारे में SenseVoice

शिक्षण एक ऐसी बोली है जो संगीत से बाहर जाती है. यह 50+1 भाषाओं को समर्थन देता है और इसमें भावना, ऑडियो घटना का पता लगाने, और पाठ को किसी एक मॉडल में लागू करने की क्षमता भी शामिल है.
मॉडल जानकारी
  • प्रदाताFunAudioLLM
  • स्फीति-
  • लाइसेंसMIT
  • अद्यतन किया गयाMar 2026

अक्सर पूछे जाने वाले प्रश्न

SenseVoice is a speech-to-text model by FunAudioLLM. STT.ai does not currently run SenseVoice — this page is reference information about the model. For transcription on STT.ai, the model picker offers the Whisper family (Turbo, Large V3, Medium, Small).

On standard benchmarks, SenseVoice achieves around 5.5% Word Error Rate. Real-world accuracy depends on audio quality, accent, and language; for noisy or accented recordings, expect a few percentage points higher WER.

SenseVoice 4,000 पर उपलब्ध नहीं है. इसके लाइसेंस के अपने खुद का आदेश यह खुद चल रहा है. STT.ai मुक्त मॉडल हम चलाने के लिए तैयार है - 600 मिनट शुरू करने के लिए, फिर एक मासिक मुक्त शीर्ष.

SenseVoice को MIT के तहत रिहा किया गया है, एक गलत खुले स्रोत लाइसेंस. आप अपने स्वयं को H-host000 पर कर सकते हैं या हमारे मेजबानित संस्करण का उपयोग कर सकते हैं - दोनों व्यावसायिक रूप से प्रयोग कर रहे हैं.

SenseVoice 50 भाषाओं का समर्थन करता है. स्वचालित रूप से ध्वनि के लिए सही भाषा लेता है; आप इसे दस्ती रूप से निर्दिष्ट कर सकते हैं एक छोटी सी सटीकता के लिए.

SenseVoice प्रक्रियाओं के बारे में 50.0x वास्तविक समय हमारे जीपी. एक 1 घंटे की ध्वनि फ़ाइल 1 मिनट में होती है, अब फ़ाइलें कतार में और ईमेल द्वारा सूचना देता है.

SenseVoice में 8800 पैरामीटर हैं. बड़ा मॉडल अधिक सही होने की पुष्टि करता है लेकिन धीमी; STT.ai सेना SenseVoice GUCHU पर तो पैरामीटर नंबर अपने ग्राहक किनारे प्रदर्शन को प्रभावित नहीं करता.

SenseVoice हर प्रारूप STT.ai समर्थन स्वीकार करता है — एमपी3, एम.4A, ओ.ए.

वक्‍ता ने हर भाषण के लिए SenseVoice लोगों के पास दौड़ता है — हर वक्‍ता पर लेबल लगाया जाता है और बाद में इन्हें संपादक में बदल सकता है ।

जी. SenseVoice हमारे सफल वातावरण में चला जाता है — ऑडियो को डिफ़ॉल्ट रूप से संसाधित किया जाता है और उसे मिटाया नहीं जाता बिना विशिष्ट स्तर के प्रशिक्षण के लिए प्रयोग किया जाता है.

एक ही ऑडियो के खिलाफ किसी भी अन्य समर्थित मॉडल को चलाने के लिए SenseVoice उपकरण का उपयोग करें - आप Werer, खण्ड गिनती, स्पीकरों, और अंक के विपरीत देखें। SenseVoice v3 बड़ा V3 तुलना आम तौर पर चल रहा है।

हाँ. "8000" मॉडल का मूल्य के रूप में निर्दिष्ट करें /v1/टैक्स अंत बिन्दु पर. पायथन और नोड शामिल है SenseVoice उदाहरण.

हाँ. क्योंकि SenseVoice है MIT-कैम्प्ड, आप यह खुद से शुरू कर सकते हैं. STT.ai के खुले स्रोत पृष्ठ सूची परियोजना रीपोस और वजन. अधिकांश उत्पादन टीमों का उपयोग GUpon, मॉडलpon, मॉडल की मात्रा छोड़ देने के लिए किया गया संस्करण, और ops.