SenseVoice

STT.ai loop nie hierdie model nie. Hierdie bladsy is verwysingsinligting daaroor. Skryf aan met die modelle wat ons wel hardloop →
5.5%
WER
50
Tale
50.0x
Spoed
MIT
Lisensie

Aangaande SenseVoice

SinVoice is 'n spraak fondasie model van FunudiLM wat verder gaan as transkripsie. Dit ondersteun 50+ tale en sluit in die vermoë om emosie te herken, klank gebeurtenis op te spoor en inverse teks normale erkenning in 'n enkele model.
Model InligtingName
  • VerskafferFunAudioLLM
  • Argitektuur-
  • LisensieMIT
  • OpgedateerCancel: Meeting NameMeetingMar 2026

Vrae wat dikwels gevra word

SenseVoice is 'n spraak-teksmodel deur FunAudioLLM. STT.ai loop nie tans SenseVoice takies aan hierdie bladsy nie is verwysinginligting oor die model. Vir transkripsie op STT.ai bied die modelpikler die Whisper - gesin (Turbo, Groot V3, Medium, Klein).

Op standaard bankmerke bereik SenseVoice om 5.5% Woord Fout tempo. Real-world akkuraatheid hang af van klankgehalte, aksent en taal; vir lawaaierige of gefluurde opnames, verwag 'n paar persentasie punte hoër WER.

SenseVoice is nie beskikbaar op STT.ai nie. Sy eie lisensieterme bepaal die loop van dit self. STT.ai se vryvlak dek die Whisper modelle wat ons wel hardloop Ã"r Ã" 600 minute om te begin, dan 'n maandelikse vry top-up.

SenseVoice word vrygestel onder MIT, 'n permissiewe open-onse lisensie. Jy kan self-host SenseVoice op jou eie hardeware of gebruik ons gegasheer weergawe 2 is kommersieel bruikbaar.

SenseVoice ondersteun 50 tale. Outo-speur die regte taal vir die meeste oudio; u kan dit ook self spesifiseer vir 'n klein akkuraatheid.

SenseVoice verwerk klank oor ongeveer 50.0x real-time op ons GPUs. 'n 1-hour klank lêer eindig onder 1 minute; langer lêers wag en inkennis stel deur e-pos wanneer dit gedoen word.

SenseVoice het 234M parameters. Groter modelle is geneig om akkurater maar stadiger te wees; STT.ai-gashere SenseVoice op GPU sodat die parametertelling nie jou kliënt-side-prestasie beïnvloed nie.

SenseVoice accepts every format STT.ai supports — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, and others. Output as TXT, SRT, VTT, DOCX, JSON, or PDF.

Ja, Speaker diarisering loop langs SenseVoice vir elke transkripsie ium ium word elke spreker gemerk en jy kan hulle na die volgende in die redigeerder hernoem.

Ja. SenseVoice loop in ons bestuurde omgewing Lazlo-oudio word verwerk en uitgevee deur verstek en nooit gebruik vir opleiding sonder eksplisiete opt-in nie. Pro planne voeg kliënt-side enkripsie vir transkripsies op res.

Gebruik die vergelyk-stel gereedskap om SenseVoice te laat loop teen enige ander ondersteunde model op dieselfde oudio DVD jy sal sien WER, segment tel, luidspreker etikette en vertroue punte kant- by-side. die SenseVoice vs Whift Groot V3 vergelyking is die algemeenste hardloop.

Ja. Spesifiseer "sensevoice" as die model parameter op die /v1/aanteken eindepunt. Python en Node.js SDKs sluit 8800 voorbeelde in. Vry 'nPI-vlak sluit 100 minute/month in.

Ja. Omdat SenseVoice MIT-licensed is, kan jy self-host dit. STT.ai se ope-bou-blad gee 'n lys van die projek repo en gewigte. Mees produksiespanne gebruik ons gemoÃ" weergawe om GPU-berigting, model ruilinge en eeps te laat vaar.