Moonshine

STT.ai ass eng Uertschaft an der Gemeng Réiden an der Provënz Lëtzebuerg. D'Modeller, déi mir lafen, transkribéieren →
7.8%
WER
1
Sproochen
80.0x
Geschwindegkeet
MIT
Lizenz

Iwwer Moonshine

Moonshine ass e ganz kompakte Sprooch-zu-Text-Modell, deen fir Ressource-beschränkt Ëmfeld entwéckelt gouf. Mat nëmmen 61M Parameteren, leeft et effizient op Randgeräter wéi Raspberry Pi, während eng raisonnabel englesch Transkriptiounsgenauegkeet behalen gëtt.

Sproochen Moonshine

Häufig gestallte Froen

Moonshine ass e Sprooch-zu-Text-Modell vum Useful Sensors. STT.ai leeft derzäit net mat Moonshine - dës Säit ass Referenzinformatioun iwwer dat Modell. Fir Transkriptioun op STT.ai bitt d'Modell-Auswiel d'Whisper-Famill (Turbo, Large V3, Medium, Small) un.

D'Zuel vun de Sproochen, déi an der Welt geschwat ginn, ass ronn 880 Milliounen, an déi meescht vun hinnen hunn eng Sprooch als Mammesprooch.

Moonshine ass net op STT.ai verfügbar. Seng eege Lizenzbedingunge bestëmmen, wéi Dir et selwer ausféiert. D'Fräiversioun vun STT.ai deckt d'Whisper-Modeller, déi mir lafen - 600 Minutten ze starten, duerno eng monatlech gratis Erhéijung.

Moonshine ass ënner der MIT, enger permissiver Open-Source-Lizenz verëffentlecht ginn. Dir kënnt Moonshine op Ärer eegene Hardware hosten oder eis gehostete Versioun benotzen - béid sinn kommerziell benotzt.

Moonshine ënnerstëtzt 1 Sproochen. D'Auto-Erkennung wielt d'richtig Sprooch fir déi meescht Audio; Dir kënnt et och manuell uginn fir eng kleng Präzisiounssteigerung.

Moonshine veraarbecht Audio mat ongeféier 80.0x Echtzäit op eise GPUen. Eng 1 Stonn laang Audiodatei ass a manner wéi 1 Minutten ofgeschloss; méi laang Dateien ginn an d'Warteschlange gesat an no der Fertigstellung per E-Mail informéiert.

Moonshine huet 61M Parameter. Grouss Modeller sinn dacks méi genee, awer méi lues; STT.ai huet Moonshine op der GPU, sou datt d'Zuel vun de Parameteren Är Clientsleeschtung net beaflosst.

Moonshine akzeptéiert all Formater déi STT.ai ënnerstëtzt — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, an aner. Ausgab als TXT, SRT, VTT, DOCX, JSON oder PDF.

D'Sprooch ass ronn 800.000 Leit bekannt, déi an der ganzer Welt geschwat ginn, an déi meescht vun hinnen an der Regioun liewen.

Ja. Moonshine leeft an eiser verwalteter Ëmwelt — Audio gëtt standardméisseg veraarbecht a geléist a gëtt ni fir Training benotzt ouni explizit Opt-in. Pro Pläng addéieren Client-säiteg Verschlësselung fir Transkriptiounen am Ruhezustand.

D'Vergleiche-stt-Tool gëtt benotzt fir Moonshine mat all anere Modeller ze vergläichen, déi op deem selwechten Audiosystem ënnerstëtzt ginn. Dobäi gesi mir WER, Segment-Zuel, Lautsprecher-Label an Zuverlässegkeetswäerter netzwierklech. De Verglach Moonshine vs Whisper Large V3 gëtt am meeschte benotzt.

Ja. Gebt "moonshine" als Modellparameter op dem /v1/transcribe Endpunkt un. Python an Node.js SDKs enthalen Moonshine Beispiller. D'gratis API-Tier enthält 100 Minutten/Mount.

Ja. Well Moonshine MIT-lizenzéiert ass, kënnt Dir et selwer hosten. D'Open-Source-Säit vun STT.ai lëscht de Projet-Repo an d'Gewiicht op. D'Meiste Produktiounsteams benotzen eis gehostete Versioun fir GPU-Beschaffung, Modell-Swaps an Ops ze iwwerhuelen.
Made by @nadermx