కలపండి SenseVoice
5.5%
WER
50
భాషలుName
50.0x
వేగము
MIT
లైసెన్స్
గురించి SenseVoice
ఎలక్ట్రానిక్ ఫెడరేషన్ అనేది ప్రొఫైల్ ఎడిషన్పై ఆధారపడినది, అది 50+ భాషలకు మద్దతునిస్తుంది, మరియు భావోద్వేగ గుర్తింపుకు, ఆడియో ఘటన గుర్తించబడడానికి, మరియు విలోమమైన పాఠ్య ఉత్పత్తులను విలోమించడం.
మోడల్ సమాచారంName
- సింద్దంచేయునదిFunAudioLLM
- ముదురు ఆలివ్ పచ్చcolor-
- లైసెన్స్MIT
- నవీకరించబడిందిMar 2026
తరచుగా అడిగే ప్రశ్నలు
SenseVoice ఒక భాషా-text నమూనా 8882.STT.ai హార్డ్వేర్లను మీ స్వంత సదుపాయం లేకుండా దీన్ని ఉపయోగించవచ్చు కాబట్టి మీరు మీ సొంత హార్డ్వేర్లు — అప్లోడ్ లేదా వీడియో ఎంచుకోండి మరియు మాదిరి నుండి SenseVoice ఎంపిక.
ప్రామాణిక బెంచ్మార్క్స్ లో SenseVoice వర్సెస్ 5.5 శాతము పదకోశం తప్పు రేటు చుట్టూ వుంటోంది. నిజమైన- లోక ఖచ్చితత్వం ఆడియో నాణ్యత, ఉచ్చారణ, భాషపై ఆధారపడి ఉంటుంది. శృంగారింపు లేదా ఉద్దీపన రికార్డింగుల కోసం కొన్ని శాతం ఎక్కువ పాయింట్లు ఆశిస్తున్నాము.
SenseVoice STT.ai యొక్క ఉచిత టైర్ న నడుస్తుంది ప్రతి సందర్శకులకు ఖర్చుతో ప్రారంభించడానికి 600 నిమిషాలు కావాలి. పాడ్ ప్రణాళికలు ఒక file పరిమితులు, వ్యక్తిగత అప్రమత్తత మరియు ప్రాధాన్యత క్రమం ఎక్కువ. ఒక i
MIT కింద SenseVoice విడుదల చేయబడుతుంది. మీరు మీ సొంత హార్డ్వేర్ SenseVoice లో స్వీయ - హోస్ట్ SenseVoice చేయవచ్చు లేదా మా హోస్ట్ వెర్షన్ వెర్షన్ ఉపయోగించవచ్చు. రెండు ఉత్సుకంగాఅనుకూలంగా ఉంటాయి.
SenseVoice భాషలు 50 భాషలకు మద్దతిస్తుంది. చాలా పెద్ద ఆడియో కొరకు సరైన భాషను స్వయంచాలకంగా తనిఖీ చేయవచ్చు; మీరు దీనిని ఒక చిన్న ఖచ్చిత వ్రైడ్ కోసం కూడా కేటాయించవచ్చు.
మా GPUS న 880x రియల్లేమ్ SenseVoice ప్రక్రియల సమయంలో ఆడియో రియల్. ఒక 1- గంటల ఆడియో ఫైల్ ముగుస్తుంది 882 నిమిషాల క్రింద; ఎక్కువ దస్త్రాలు వరుసలో క్రమంలో మరియు ఈమెయిల్ ద్వారా తెలియజేయబడుతుంది.
SenseVoice దగ్గర 8802 గణాంకాలు ఉంటాయి. పెద్ద మోడల్ మరింత ఖచ్చితమైనవి కానీ వేగం తక్కువగా ఉంటుంది. STT.ai హోస్ట్లు; GPU న 8SenseVoice పై వుపతాణ కౌంట్ మీ క్లైంట్ యొక్క సౌలభ్యాను ప్రభావితం లేదు.
8801 ప్రతి ఫాధైర్య STT.ai మద్దతులను అంగీకరిస్తుంది — MP3, WAV, MAG, OGG4, MCV, MOV, MOV, వెబ్నో, AVI, మరియు ఇతర. అవుట్పుట్ TXT, SRT, DOT, DOT, DCX, JSX, JSC, లేదా PDF గా.
ఆ తర్వాత మీరు వాటిని పరిణామక్రమంలో రాసుకోవచ్చు.
SenseVoice మన కృత్రిమ వాతావరణంలో నడుస్తుంది — ఆడియో అప్రమేయంగా ప్రక్రియ మరియు తీసివేయబడుతుంది మరియు ఎటువంటి విస్తీర్ణత లేకుండా శిక్షణ కోసం ఎప్పుడూ. ప్రోగ్రాంలు రికేషన్స్ కోసం క్లైంట్- వైపు నినాప్ చేర్చండి.
అదే ఆడియోనందు మ్యాచ్డ్డ్ SenseVoice మ్యాచ్డ్ను నడుపుటకు పోల్చు-tt ఉపకరణాన్ని వుపయోగించుము — మీరు WER, భాగపు కౌంటీ కౌంటర్, స్పీకర్ లేబుల్స్, మరియు నమ్మదగ్గ స్కోర్లను ప్రక్కకు చూస్తారు. SenseVoice vs Whisper v1 పెద్ద V3 పోల్చు సర్వసాధారణంగా నడుపుతుంది.
. i అవును, "8000" ను /v1/trainch కు నమూనా అంశంగా గుర్తించుము. Python మరియు SDKs. 8801 ఉదాహరణలు కలిగివుంటుంది. ఫ్రీ API టైకర్ 100 minutes కలిగివుంటుంది.
SenseVoice ఉంది ఎందుకంటే MIT-licented ఉంది, మీరు స్వీయ-పోర్టర్లను చేయవచ్చు STT.ai యొక్క ఓపెన్ పేజీ ప్రాజెక్టు repo మరియు బరువులను జాబితాలో ఉంది. చాలా ఉత్పత్తి బృందం GPU బృందం GPU బృందం, మాదిరి బదిలీలు మరియు ops కోసం మా వుడ్ వెర్షన్ వెర్షన్ ఉపయోగిస్తారు.