Moonshine
STT.ai køyrer ikkje denne modellen — denne sida er referanseinformasjon om han.
Transkriber med modellane vi køyrer →
7.8%
WER
1
Språk
80.0x
Fart
MIT
Lisens
Om Moonshine
Moonshine er ein ekstremt kompakt tale-til-tekst-modell som er laga for ressurssvake miljø. Med berre 61M parameterar, køyrer han effektivt på kanteinningar som Raspberry Pi, samtidig som han opprettheld ein rimeleg nøyaktigheit i engelsk transkripsjon.
Språk støtta av Moonshine
Modellinformasjon
- TilbydarUseful Sensors
- Arkitektur-
- LisensMIT
- OppdatertMar 2026
Ofte stilte spørsmål
Moonshine er ein tale-til-tekst-modell frå Useful Sensors. STT.ai køyrer ikkje Moonshine for tida — denne sida er referanseinformasjon om modellen. For transkripsjon på STT.ai, tilbyr modellveljaren Whisper-familien (Turbo, Large V3, Medium, Small).
På standard målestokkar oppnår Moonshine om lag 7.8% ordfeilrate. Nøyaktigheita i verkeleg liv avheng av lydkvalitet, aksent og språk. For støyande eller aksenterte opptak, kan du venta eit par prosentpoeng høgare WER.
Moonshine er ikkje tilgjengeleg på STT.ai. Det har sine eigne lisensvilkår som styrer korleis du køyrer det sjølv. STT.ai sitt gratisnivå dekkjer Whisper-modellene vi køyrer — 600 minutt til å starta, så ein månadleg gratis oppgradering.
Moonshine er utgjeve under MIT, ein permissiv open kjeldekode-lisens. Du kan sjølv ha Moonshine på din eigen maskinvare eller bruke vår vertsversjon — begge er kommersielt brukbare.
Moonshine støttar 1 språk. Automatisk oppdaging vel det rette språket for dei fleste lydfiler. Du kan òg velja språket manuelt for å få ein liten forbetring av nøyaktigheita.
Moonshine prosesserer lyd med om lag 80.0x sanntid på grafikkprosessorane våre. Ein 1-timers lydfil er ferdig på under 1 minutt. Lengre filer vert lagt i kø og varsla via e-post når dei er ferdige.
Moonshine har 61M-parametrar. Større modeller har ein tendens til å vera meir nøyaktige, men tregare. STT.ai er vert for Moonshine på GPU-en, så parametertalet påverkar ikkje ytinga på klientsida.
Moonshine godtek alle formata STT.ai støttar — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI og andre. Utdata som TXT, SRT, VTT, DOCX, JSON eller PDF.
Ja. Diarisering av talarar køyrer saman med Moonshine for kvar transkripsjon — kvar talar er merket og du kan endra namnet på dei i redigeringa etterpå.
Ja. Moonshine køyrer i vårt administrerte miljø – lyd blir handsama og sletta som standard og blir aldri brukt til opplæring utan eksplisitt samtykke. Pro-planar legg til klientkryptering for avskriftar i ro.
Bruk verktøyet compare-stt for å køyra Moonshine mot ein annan støtta modell på same lyd. Du vil sjå WER, segmenttal, høgtalarnamn og tiltrupoeng side om side. Samanlikninga Moonshine vs Whisper Large V3 er den mest brukte.
Ja. Oppgje «moonshine» som modellparameter på /v1/transcribe-endepunktet. Python- og Node.js-SDK-ar inneheld Moonshine-eksempela. Gratis API-nivå inkluderer 100 minutt/månad.
Ja. Sidan Moonshine er MIT-lisensiert, kan du sjølv vera vert for det. STT.ai sin open kjeldekode-side viser prosjektarkivet og vektene. Dei fleste produksjonsteam brukar vår vertsversjon for å hoppa over GPU-innkjøp, modellbytte og operasjonar.