Moonshine

STT.ai ne pokreće ovaj model - ova stranica je referentna informacija o njemu. Prepisivati sa modelima koje radimo →
7.8%
WER
1
Jezici
80.0x
Brzina
MIT
Licenca

O meni Moonshine

Moonshine je izuzetno kompaktan model govora u tekst dizajniran za okruženja ograničenih resursa. Sa samo 61M parametara, efikasno radi na periferijskim uređajima kao što je Raspberry Pi, održavajući razumnu tačnost engleskog transkripcije.

Jezici podržani Moonshine

Često postavljana pitanja

Moonshine je model govora-u-tekst od strane Useful Sensors. STT.ai trenutno ne pokreće Moonshine — ova stranica je referentna informacija o modelu. Za transkripciju na STT.ai, birač modela nudi Whisper porodicu (Turbo, Large V3, Medium, Small).

Na standardnim benchmarkima, Moonshine postiže oko 7.8% stope greške riječi. realna tačnost zavisi od kvaliteta zvuka, naglaska i jezika; za bučne ili naglašene snimke, očekujte nekoliko postotnih bodova više WER.

Moonshine nije dostupan na STT.ai. Njegovi vlastiti licencni uvjeti upravljaju njegovim pokretanjem. STT.ai-in besplatni nivo pokriva Whisper modele koje mi pokrećemo - 600 minuta za početak, zatim mjesečno besplatno nadopunjavanje.

Moonshine je objavljen pod MIT, dozvoljenom licencom otvorenog koda.Možete sami hostati Moonshine na svom hardveru ili koristiti našu hosted verziju — obje su komercijalno upotrebljive.

Moonshine podržava 1 jezika. Automatsko otkrivanje bira ispravan jezik za većinu audio; također ga možete ručno odrediti za malo povećanje tačnosti.

Moonshine obrađuje audio na oko 80.0x real-time na našim GPU-ovima. 1-satna audio datoteka završava za manje od 1 minuta; dulje datoteke čekaju i obavještavaju e-mailom kada je završeno.

Moonshine ima 61M parametra. Veći modeli imaju tendenciju da budu precizniji ali sporiji; STT.ai hosta Moonshine na GPU tako da broj parametara ne utječe na performanse klijenta.

Moonshine prihvaća svaki format koji podržava STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI i drugi. izlaz kao TXT, SRT, VTT, DOCX, JSON, ili PDF.

Da. Diarizacija govornika radi zajedno sa Moonshine za svaku transkripciju - svaki govornik je označen i možete ih preimenovati u editoru kasnije.

Da. Moonshine radi u našoj upravljanoj okolini — audio se obrađuje i briše po zadanim postavkama i nikada se ne koristi za trening bez eksplicitnog uključivanja. Pro planovi dodaju šifriranje na strani klijenta za transkripte u mirovanju.

Koristite compare-stt alat da pokrenete Moonshine protiv bilo kojeg drugog podržanog modela na istom audio — vidjet ćete WER, broj segmenata, oznake zvučnika, i pouzdanost ocjena jedan pored drugog. Moonshine vs Whisper Large V3 usporedba je najčešća.

Da. Navedite "moonshine" kao modelni parametar na /v1/transcribe krajnjoj tački. Python i Node.js SDK-ovi uključuju Moonshine primjere. Besplatni API nivo uključuje 100 minuta/mjesečno.

Da. Budući da je Moonshine licenciran za MIT, možete ga sami postaviti. Stranica otvorenog koda za STT.ai navodi projektni repozitorij i težine. Većina produkcijskih timova koristi našu verziju za preskakanje nabavke GPU-a, zamjene modela i operacija.
Made by @nadermx