SenseVoice

STT.ai ഈ മാതൃക പ്രവര്‍ത്തിക്കുന്നില്ല. ഈ താള്‍ അതിനെക്കുറിച്ചുള്ള പരാമർശ വിവരങ്ങളാണ്. നമ്മള്‍ പ്രവര്‍ത്തിക്കുന്ന മോഡലുകള്‍ റെന്‍റിംഗ് →
5.5%
WER
50
ഭാഷകള്‍
50.0x
വേഗത
MIT
അനുമതി

സംബന്ധിച്ച് SenseVoice

ഇന്ദ്രിയസംവേദനത്തിനു് അപ്പുറമുള്ള 50+ ഭാഷകളെ ഇതു പിന്തുണയ്ക്കുന്നു. വികാരനിന്ദ, ഓഡിയോ സംഭവം തിരിച്ചറിയല്‍, ഇന്റര്‍ഫെക്റ്റ് ടെക്സ്റ്റിങ്ങ് എന്നിവയുടെ കഴിവുകള്‍ ഉള്‍പ്പെടുത്തുന്നു.
മോഡല്‍ വിവരംName
  • ദാതാവ്FunAudioLLM
  • ഭൂമദ്ധ്യരേഖ/ അഗ്രകോടി ഉയര്‍ത്തല്‍ [ENTER]-
  • അനുമതിMIT
  • പരിഷ്കരിച്ചിരിക്കുന്നുMar 2026

പതിവുചോദിക്കുന്ന ചോദ്യങ്ങള്‍

SenseVoice is a speech-to-text model by FunAudioLLM. STT.ai does not currently run SenseVoice — this page is reference information about the model. For transcription on STT.ai, the model picker offers the Whisper family (Turbo, Large V3, Medium, Small).

സ്റ്റാന്‍ഡേര്‍ഡ് ബെഞ്ച് മാര്‍ക്കില്‍, SenseVoice വര്‍ക്ക് 5.5% വാല്യത്തിന്റെ പിശകുകള്‍ ഉണ്ടാകുന്നു. യഥാര്‍ത്ഥ-ലോക കൃത്യത ഓഡിയോ ഗുണഗണത്തെയും ഭാഷയെയും ആശ്രയിച്ചിരിക്കുന്നു. ശബ്ദമോ ഉദ്ധരിച്ചോ റെക്കോര്‍ഡ് ചെയ്തോ ചില ശതമാനം പോയിന്റുകള്‍ പ്രതീക്ഷിക്കുന്നു.

SenseVoice STT.aiല്‍ ലഭ്യമല്ല. അതിന്‍റെ സ്വന്തം ലൈസന്‍സ് റെഡിപ്രോക്കല്‍ റെഡി ആണ്. STT.ai ന്‍റെ സ്വതന്ത്ര പ്ളെര്‍ ഡ്രസ്‌ മോഡിഫുകള്‍, നമ്മള്‍ പ്രവര്‍ത്തിക്കുന്ന STT.ai മിനിറ്റ്, അത് തുടങ്ങാന്‍ 600 മിനിറ്റ്, ഒരു മാസത്തെ ഒരു മാസത്തെ മേലെ ഫ്രീ ആയി.

MIT ല്‍ നിന്നും SenseVoice റിസള്‍ട്ട് ചെയ്യുന്നു. നിങ്ങള്‍ക്ക് സ്വന്തം ഹാര്‍ഡ്‌വെയര്‍ SenseVoice ഉപയോഗിക്കാം അല്ലെങ്കില്‍ നമ്മുടെ ഹോര്‍ഡ്‌വെയര്‍ പതിപ്പ് ഉപയോഗിക്കാം. രണ്ടും വാണിജ്യപരമായി ഉപയോഗിക്കാം.

50 ഭാഷകള്‍ പിന്തുണയ്ക്കുന്നു SenseVoice. മിക്ക ശബ്ദങ്ങള്‍ക്കും ശരിയായ ഭാഷ തെരഞ്ഞെടുക്കുന്നു; നിങ്ങള്‍ക്കു് ഒരു ചെറിയ സാങ്കേതിക സ്ക്രീനില്‍ സ്വയമായി വ്യക്തമാക്കാം.

SenseVoice processes audio at about 50.0x real-time on our GPUs. A 1-hour audio file finishes in under 1 minutes; longer files queue and notify by email when done.

SenseVoice-നു് 234M പരാമീറ്ററുകള്‍ ഉണ്ട്. വലിയ മോഡലുകള്‍ കൂടുതല്‍ കൃത്യതയുള്ളതായിരിക്കും, പക്ഷെ വേഗത കുറവാണു്; STT.ai ഹോസ്റ്റുകള്‍ GPU യിലെ 8SenseVoice ആയതിനാല്‍ പരാമീറ്റര്‍ എണ്ണം നിങ്ങളുടെ ക്ലയന്റിന്റെ വശത്തെ പ്രകടനത്തെ ബാധിക്കുന്നില്ല.

SenseVoice എല്ലാ രീതിയിലും STT.ai പിന്തുണ സ്വീകരിക്കുന്നു — MP3, WAV, MAG, OGG, OGG4, MMCV, MOV, MOV, വെബ്‌എം, എവിഐ, മറ്റ്വ. ടിഎക്സ്, SXT, DOT, DCX, VX, JSON അല്ലെങ്കില്‍ അല്ലെങ്കില്‍.

ഓരോ പ്രഭാഷകനും SenseVoice - ത്തോളം പ്രഭാഷണം നടത്തുന്നു.

യെസ്. SenseVoice നമ്മുടെ പരിസ്ഥിതിയില്‍ പ്രവര്‍ത്തിക്കുന്നുണ്ട്. ഓഡിയോ പ്രവര്‍ത്തനത്തില്‍ സഹജമായി വെട്ടിമാറ്റി നീക്കം ചെയ്യുന്നു. വ്യക്തമായും പരിശീലനം ലഭിക്കാന്‍ ഉപയോഗിക്കാറില്ല. പ്രോപ്ലേ പ്രോജക്റ്റുകള്‍ ക്ളൈന്‍റെ ഇടതുഭാഗത്തുള്ള എന്‍ക്രിപ്റ്റിന്റെ രഹസ്യഭാഷ കൂട്ടിച്ചേര്‍ക്കുക.

Use the compare-stt tool to run SenseVoice against any other supported model on the same audio — you'll see WER, segment count, speaker labels, and confidence scores side-by-side. The SenseVoice vs Whisper Large V3 comparison is the most commonly run.

അതെ, /v1/traannation സൂചികയില്‍ "sensevoice" പരാമീറ്റര്‍ ആയി വ്യക്തമാക്കുക. പൈത്തണ്‍ ആന്‍ഡ് എഡ്ഡികെസ് SenseVoice ഉദാഹരണങ്ങള്‍ ഉള്‍‌ക്കൊള്ളുന്നു. സ്വതന്ത്ര API സ്ലേറ്റര്‍ 100 min/ മാസങ്ങള്‍ ഉള്‍പ്പെടുന്നു.

SenseVoice 8801 MIT ലക്ചറന്‍റ് ആയതിനാല്‍ നിങ്ങള്‍ക്കത് സ്വയം ഹോസ്റ്റര്‍ ചെയ്യാം. STT.ai തുറക്കുന്ന താള്‍ പ്രോജക്റ്റും തൂക്കവും പട്ടികപ്പെടുത്തുന്നു. മിക്ക ഉല്‍പാദനങ്ങളും GPUFFS, മോഡല്‍ സ്യൂട്ടും, ops എന്നിവ ഒഴിവാക്കാന്‍ നമ്മുടെ ഹോസ്റ്റര്‍ ഫോര്‍ട്ടര്‍ പതിപ്പ് ഉപയോഗിക്കുന്നു.