SenseVoice
Tsy mandeha amin'ny STT.ai ity modely ity. Lazan'ny rohy momba azy io pejy io.
Adikao amin'ny modely ampiasaintsika →
5.5%
WER
50
Teny
50.0x
Hafainganan'ny fanovana
MIT
Lisansa
Mombamomba SenseVoice
SenseVoice dia modely fototry ny fitenenana avy amin'ny FunAudioLLM izay mihoatry ny fandikana. Manaiky fiteny mihoatra ny 50 izy ary ahitana ny fahaizana mahafantatra fihetseham-po, ny fitadiavana zava-mitranga amin'ny feo, ary ny fanovana ny soratra ho lasa mahazatra ao anatin'ny modely iray.
Teny raisina an-tànana SenseVoice
Lazan'ny modely
- Mpanome tolotraFunAudioLLM
- Arkitektora-
- LisansaMIT
- Vao hainganaMar 2026
Fanontaniana matetika
Ny SenseVoice dia modely fanononana-ho-soratra avy amin'ny FunAudioLLM. Tsy mandeha amin'izao fotoana izao ny SenseVoice amin'ny STT.ai — fampahalalana iantsoana momba ilay modely ity pejy ity. Ho an'ny fanoratana amin'ny STT.ai, dia manolotra ny fianakavian'ny Whisper (Turbo, Large V3, Medium, Small) ny mpifidy modely.
Ny fiteny anglisy dia manana fiteny fototra 8, izay mizara ho fiteny anglisy fototra, fiteny anglisy fototra 2, fiteny anglisy fototra 3 ary fiteny anglisy fototra 4.
Tsy misy ny SenseVoice amin'ny STT.ai. Ny fepetran'ny fahazoan-dàlana manokana no mifehy ny fandefasana azy. Ny ambaratonga maimaimpoana amin'ny STT.ai dia ahitana ny modely Whisper izay alefantsika — 600 minitra hanombohana, avy eo fanampiana maimaimpoana isam-bolana.
Avy amin'ny MIT, fahazoan-dàlana malalaka, no namoahana ny SenseVoice. Afaka mametraka ny SenseVoice amin'ny solosainao ianao na mampiasa ny kinova napetrakay — samy azo ampiasaina amin'ny varotra daholo izy roa ireo.
Ny SenseVoice dia mandray an-tànana ny fiteny 50. Ny famantarana hoazy dia misafidy ny fiteny mety amin'ny ankamaroan'ny feo; azonao atao koa ny milaza izany amin'ny tanana mba hahazoana fitomboana kely amin'ny fahamarinana.
Ny SenseVoice dia mandray feo amin'ny hafainganam-pandeha 50.0x eo ho eo amin'ny GPU-ntsika. Ny rakitra audio 1 ora dia vita ao anatin'ny 1 minitra; ny rakitra lava kokoa dia miandry ary omena fampandrenesana amin'ny mailaka rehefa vita.
Manana sivana 234M ny SenseVoice. Ny modely lehibe kokoa dia mety ho marina kokoa nefa miharatsy; ny STT.ai dia miahy ny SenseVoice amin'ny GPU ka tsy misy fiantraikany amin'ny fahombiazan'ny mpivatsy ny isan'ny sivana.
Manaiky ny endrika rehetra raisin'ny STT.ai an-tànana ny SenseVoice — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, ary ny hafa. Ny vokatra dia TXT, SRT, VTT, DOCX, JSON, na PDF.
Eny. Miaraka amin'ny SenseVoice ny diarization-n'ny mpiteny ho an'ny fandikana tsirairay — misy ny marika ho an'ny mpiteny tsirairay ary afaka manova ny anarany ao amin'ny mpanova lahatsoratra ianao aorian'izay.
Eny. SenseVoice no mandeha ao anatin'ny tontolo iainana fehezinay — ny feo dia voasarika sy fafàna araka ny lasitra ary tsy ampiasaina mihitsy ho an'ny fanazarantena raha tsy misy fankatoavana mazava. Ny drafitra Pro dia mampiditra ny fanafangoana amin'ny lafiny mpivatsy ho an'ny dikan-teny tsy miasa.
Ampiasao ny fitaovana compare-stt handefasana ny SenseVoice amin'ny modely hafa raisina an-tànana amin'ny feo mitovy — hahita ny WER, ny isan'ny faritra, ny mari-tsoratra amin'ny mpandahateny, ary ny isa azo antoka mifampitohy ianao. Ny fampitahana ny SenseVoice amin'ny Whisper Large V3 no ampiasaina matetika indrindra.
Eny. Lazao ny "sensevoice" ho toy ny singa mpifehy modely amin'ny /v1/transcribe endpoint. Ny SDK'ny Python sy ny Node.js dia ahitana ohatra SenseVoice. Ny ambaratonga API maimaimpoana dia ahitana 100 minitra isan-bolana.
Eny. Satria manana fahazoan-dàlana MIT ny SenseVoice, afaka mikarakara azy ianao. Ny pejy loharano misokatra an'ny STT.ai dia manome lisitra ny repository sy ny lanjany. Ny ankamaroan'ny ekipa mpamokatra dia mampiasa ny kinova nokarakarainay mba tsy hijerena ny fividianana GPU, ny fifanakalozana modely, ary ny ops.