SenseVoice

STT.ai haina kutamba iyi model. Iyi peji ndeyokuongorora ruzivo nezve iyo. Transcribe ne models isu tinoita run →
5.5%
WER
50
Zvinhu
50.0x
_Kukurumidza
MIT
License

Chii SenseVoice

SenseVoice inyanzvi yekutaura kubva kuFunAudioLLM, inobatsira kushandura mazita evanhu, mashoko, uye mazita ezvinyorwa. Inoshanda ne50+ mazita ezvinyorwa uye inosanganisira kukwanisa kuongorora pfungwa, kuongorora mazita ezvinyorwa, uye kushandura mazita ezvinyorwa kuita zvinyorwa.

Zvimwe zvinobvunzwa kakawanda

SenseVoice imhando yemutauro-ku-mutauro yakagadzirwa neFunAudioLLM. STT.ai haina kutamba SenseVoice parizvino — iyi peji inoratidza ruzivo nezvemutauro. Kuti uite transliteration paSTT.ai, mutauro unotora unopa Whisper (Turbo, Large V3, Medium, Small).

Real-world kunyatsonzwisisa kunoenderana nemhando yezwi, accent, uye rurimi; For noisy kana accented rekodhi, kutarisira zvishoma zvidimbu zviviri zvemazana yepamusoro WER.

SenseVoice haisi kuwanikwa pa STT.ai. Yayo pachayo chibvumirano chekubvumidzwa zvinodzora kumisikidza iwe pachako. STT.ai's free tier inobata Whisper mamodheru isu tinoita kumisikidza — 600 maminitsi kuti awane, uyezve, pamwedzi, hapana kubhadharwa.

SenseVoice inoburitswa pasi peMIT, iyo yakavhurika-chigadzirwa chigadzirwa chitupa. Iwe unogona kuisa SenseVoice pane yako hardware kana kushandisa yedu inochengetwa vhezheni. Imwe neimwe inoshandiswa mukutengesa.

SenseVoice inotsigira 50 mazita ezvinyorwa. Kuwana otomatiki kunosarudza zvirinani zita rezvinyorwa zvemavhidhiyo; unogonawo kuisarudza nemunhu kuti uwane kunyatsoita kwakanaka.

SenseVoice inogadzirisa audio pazvinosvika 50.0x real-time pane edu GPUs. 1-hour audio file inosvika pasi pe 1 maminitsi; zvinopfuura zvinyorwa zvinomirira uye zvinozivisa neemail kana zvaitwa.

SenseVoice ine 234M parameters. Larger models tend to be more accurate but slower; STT.ai hosts SenseVoice on GPU so the parameter count doesn't affect your client-side performance.

SenseVoice inogamuchira ese mafomati STT.ai anotsigira - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, uye vamwe.Kuburitsa se TXT, SRT, VTT, DOCX, JSON, kana PDF.

Yega. Mutauro diarization inofamba pamwe SenseVoice yese transcription — mumwe mutauro iri rakanyorwa uye unogona kuchinja zita ravo mu editor mushure.

Yeah. SenseVoice runs in our managed environment — audio is processed and deleted by default and never used for training without explicit opt-in. Pro plans add client-side encryption for transcripts at rest.

Usati washandisa SenseVoice, shandisawo SenseVoice vs Whisper Large V3 kuongorora kuti uone kuti SenseVoice inoenderana nemhando ipi neipi yefoni. Unogona kuona WER, segment count, speaker labels, uye confidence scores side-by-side. SenseVoice vs Whisper Large V3 kuongorora ndiyo inonyanya kushandiswa.

Yeah. Chidza "sensevoice" separameter yemufananidzo pa /v1/transcribe endpoint. Python uye Node.js SDKs dzinosanganisira SenseVoice mifananidzo. Yemahara API tier inosanganisira 100 maminitsi / mwedzi.

Yeah. Nekudaro, nekuti SenseVoice ine MIT-lisensi, unogona kuichengeta iwe pachako. STT.ai's open-source peji rinonyora repo uye zviyero zveprojekiti. Zvikwata zvakawanda zvekugadzira zvinoshandisa yedu inochengetwa vhezheni kuti urege kubhadharisa GPU, kuchinja mamodheru, uye ops.