Moonshine
STT.ai ne pokreće ovaj model - ova stranica je referentna informacija o njemu.
Prepisivati sa modelima koje radimo →
7.8%
WER
1
Jezici
80.0x
Brzina
MIT
Licenca
O meni Moonshine
Moonshine je izuzetno kompaktan model govora u tekst dizajniran za okruženja ograničenih resursa. Sa samo 61M parametara, efikasno radi na periferijskim uređajima kao što je Raspberry Pi, održavajući razumnu tačnost engleskog transkripcije.
Jezici podržani Moonshine
Informacije o modelu
- ProviderUseful Sensors
- Arhitektura-
- LicencaMIT
- AžuriranoMar 2026
Često postavljana pitanja
Moonshine je model govora-u-tekst od strane Useful Sensors. STT.ai trenutno ne pokreće Moonshine — ova stranica je referentna informacija o modelu. Za transkripciju na STT.ai, birač modela nudi Whisper porodicu (Turbo, Large V3, Medium, Small).
Na standardnim benchmarkima, Moonshine postiže oko 7.8% stope greške riječi. realna tačnost zavisi od kvaliteta zvuka, naglaska i jezika; za bučne ili naglašene snimke, očekujte nekoliko postotnih bodova više WER.
Moonshine nije dostupan na STT.ai. Njegovi vlastiti licencni uvjeti upravljaju njegovim pokretanjem. STT.ai-in besplatni nivo pokriva Whisper modele koje mi pokrećemo - 600 minuta za početak, zatim mjesečno besplatno nadopunjavanje.
Moonshine je objavljen pod MIT, dozvoljenom licencom otvorenog koda.Možete sami hostati Moonshine na svom hardveru ili koristiti našu hosted verziju — obje su komercijalno upotrebljive.
Moonshine podržava 1 jezika. Automatsko otkrivanje bira ispravan jezik za većinu audio; također ga možete ručno odrediti za malo povećanje tačnosti.
Moonshine obrađuje audio na oko 80.0x real-time na našim GPU-ovima. 1-satna audio datoteka završava za manje od 1 minuta; dulje datoteke čekaju i obavještavaju e-mailom kada je završeno.
Moonshine ima 61M parametra. Veći modeli imaju tendenciju da budu precizniji ali sporiji; STT.ai hosta Moonshine na GPU tako da broj parametara ne utječe na performanse klijenta.
Moonshine prihvaća svaki format koji podržava STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI i drugi. izlaz kao TXT, SRT, VTT, DOCX, JSON, ili PDF.
Da. Diarizacija govornika radi zajedno sa Moonshine za svaku transkripciju - svaki govornik je označen i možete ih preimenovati u editoru kasnije.
Da. Moonshine radi u našoj upravljanoj okolini — audio se obrađuje i briše po zadanim postavkama i nikada se ne koristi za trening bez eksplicitnog uključivanja. Pro planovi dodaju šifriranje na strani klijenta za transkripte u mirovanju.
Koristite compare-stt alat da pokrenete Moonshine protiv bilo kojeg drugog podržanog modela na istom audio — vidjet ćete WER, broj segmenata, oznake zvučnika, i pouzdanost ocjena jedan pored drugog. Moonshine vs Whisper Large V3 usporedba je najčešća.
Da. Navedite "moonshine" kao modelni parametar na /v1/transcribe krajnjoj tački. Python i Node.js SDK-ovi uključuju Moonshine primjere. Besplatni API nivo uključuje 100 minuta/mjesečno.
Da. Budući da je Moonshine licenciran za MIT, možete ga sami postaviti. Stranica otvorenog koda za STT.ai navodi projektni repozitorij i težine. Većina produkcijskih timova koristi našu verziju za preskakanje nabavke GPU-a, zamjene modela i operacija.