SenseVoice

STT.ai ఈ నమూనాను నడుపలేదు. ఈ పుట దాని గురించి ప్రస్తావన సమాచారం. మేముఅలవాట్లుమీరుకారుఉందిఉందికరించండి →
5.5%
WER
50
భాషలుName
50.0x
వేగము
MIT
లైసెన్స్

గురించి SenseVoice

ఎలక్ట్రానిక్‌ ఫెడరేషన్‌ అనేది ప్రొఫైల్ ఎడిషన్‌పై ఆధారపడినది, అది 50+ భాషలకు మద్దతునిస్తుంది, మరియు భావోద్వేగ గుర్తింపుకు, ఆడియో ఘటన గుర్తించబడడానికి, మరియు విలోమమైన పాఠ్య ఉత్పత్తులను విలోమించడం.
మోడల్ సమాచారంName
  • సింద్దంచేయునదిFunAudioLLM
  • ముదురు ఆలివ్ పచ్చcolor-
  • లైసెన్స్MIT
  • నవీకరించబడిందిMar 2026

తరచుగా అడిగే ప్రశ్నలు

SenseVoice is a speech-to-text model by FunAudioLLM. STT.ai does not currently run SenseVoice — this page is reference information about the model. For transcription on STT.ai, the model picker offers the Whisper family (Turbo, Large V3, Medium, Small).

ప్రామాణిక బెంచ్‌మార్క్స్ లో SenseVoice వర్సెస్ 5.5 శాతము పదకోశం తప్పు రేటు చుట్టూ వుంటోంది. నిజమైన- లోక ఖచ్చితత్వం ఆడియో నాణ్యత, ఉచ్చారణ, భాషపై ఆధారపడి ఉంటుంది. శృంగారింపు లేదా ఉద్దీపన రికార్డింగుల కోసం కొన్ని శాతం ఎక్కువ పాయింట్లు ఆశిస్తున్నాము.

SenseVoice STT.ai లో అందుబాటులో లేదు. దాని సొంత లైసెన్సులే అది స్వయంగా అమలులో. STT.ai యొక్క ఉచిత నిమిత్తమైన టైర్ మాడ్యూలు నడపడం గురించి, అంటే ప్రారంభించడానికి 600 నిమిషాల, ఒక నెల పైన ఉచిత ఉచితంగా నిమిత్తమైన టాప్ ఇంధనం. మరియు మేము ఈ మార్గంలో అమలు చెయ్యాలి. మరియు మేము ఒక నిరూపణ లోకి మేము ఒక నిరూపణ కోసం ఒక నిమిత్తు కోసం ఒక నిరూపణ లోకి మేము ఒక లెట్ మరియు మేము ఒక నిరూపణ లోకి లెట్ మరియు మేము ఒక నిరూపణ లోకి లెట్ మరియు మేము ఒక లెట్ కోసం ఒక లెట్ కోసం కోసం కోసం కోసం ఒక లెట్ మరియు మేము ఒక లెట్ మరియు మేము ఒక లెట్ ఉంది మరియు మేము ఒక నిరూపణన మరింత సురక్షితమైన స్పెయిడ్ లోడ్ లోడ్ లోడ్స్.

MIT కింద SenseVoice విడుదల చేయబడుతుంది. మీరు మీ సొంత హార్డ్వేర్ SenseVoice లో స్వీయ - హోస్ట్ SenseVoice చేయవచ్చు లేదా మా హోస్ట్ వెర్షన్ వెర్షన్ ఉపయోగించవచ్చు. రెండు ఉత్సుకంగాఅనుకూలంగా ఉంటాయి.

SenseVoice భాషలు 50 భాషలకు మద్దతిస్తుంది. చాలా పెద్ద ఆడియో కొరకు సరైన భాషను స్వయంచాలకంగా తనిఖీ చేయవచ్చు; మీరు దీనిని ఒక చిన్న ఖచ్చిత వ్రైడ్ కోసం కూడా కేటాయించవచ్చు.

మా GPUS న 880x రియల్లేమ్ SenseVoice ప్రక్రియల సమయంలో ఆడియో రియల్. ఒక 1- గంటల ఆడియో ఫైల్ ముగుస్తుంది 882 నిమిషాల క్రింద; ఎక్కువ దస్త్రాలు వరుసలో క్రమంలో మరియు ఈమెయిల్ ద్వారా తెలియజేయబడుతుంది.

SenseVoice దగ్గర 8802 గణాంకాలు ఉంటాయి. పెద్ద మోడల్ మరింత ఖచ్చితమైనవి కానీ వేగం తక్కువగా ఉంటుంది. STT.ai హోస్ట్లు; GPU న 8SenseVoice పై వుపతాణ కౌంట్ మీ క్లైంట్ యొక్క సౌలభ్యాను ప్రభావితం లేదు.

8801 ప్రతి ఫాధైర్య STT.ai మద్దతులను అంగీకరిస్తుంది —⁠ MP3, WAV, MAG, OGG4, MCV, MOV, MOV, వెబ్‌నో, AVI, మరియు ఇతర. అవుట్‌పుట్ TXT, SRT, DOT, DOT, DCX, JSX, JSC, లేదా PDF గా.

ఆ తర్వాత మీరు వాటిని పరిణామక్రమంలో రాసుకోవచ్చు.

SenseVoice మన కృత్రిమ వాతావరణంలో నడుస్తుంది —⁠ ఆడియో అప్రమేయంగా ప్రక్రియ మరియు తీసివేయబడుతుంది మరియు ఎటువంటి విస్తీర్ణత లేకుండా శిక్షణ కోసం ఎప్పుడూ. ప్రోగ్రాంలు రికేషన్స్ కోసం క్లైంట్- వైపు నినాప్ చేర్చండి.

అదే ఆడియోనందు మ్యాచ్‌డ్‌డ్ SenseVoice మ్యాచ్‌డ్‌ను నడుపుటకు పోల్చు-tt ఉపకరణాన్ని వుపయోగించుము —⁠ మీరు WER, భాగపు కౌంటీ కౌంటర్, స్పీకర్ లేబుల్స్, మరియు నమ్మదగ్గ స్కోర్‌లను ప్రక్కకు చూస్తారు. SenseVoice vs Whisper v1 పెద్ద V3 పోల్చు సర్వసాధారణంగా నడుపుతుంది.

. i అవును, "8000" ను /v1/trainch కు నమూనా అంశంగా గుర్తించుము. Python మరియు SDKs. 8801 ఉదాహరణలు కలిగివుంటుంది. ఫ్రీ API టైకర్ 100 minutes కలిగివుంటుంది.

SenseVoice ఉంది ఎందుకంటే MIT-licented ఉంది, మీరు స్వీయ-పోర్టర్లను చేయవచ్చు STT.ai యొక్క ఓపెన్ పేజీ ప్రాజెక్టు repo మరియు బరువులను జాబితాలో ఉంది. చాలా ఉత్పత్తి బృందం GPU బృందం GPU బృందం, మాదిరి బదిలీలు మరియు ops కోసం మా వుడ్ వెర్షన్ వెర్షన్ ఉపయోగిస్తారు.