Moonshine

STT.ai nuk e përdor këtë model — kjo faqe është informacion referues për të. Transkribo me modelet që kemi. →
7.8%
WER
1
Gjuhë
80.0x
Shpejtësia
MIT
Liçenca

Për Moonshine

Moonshine është një model shumë kompakt i fjalës në tekst të projektuar për mjedise me burime të kufizuara. Me vetëm 61M parametra, ai punon efektivisht në pajisje të vogla si Raspberry Pi ndërsa ruan saktësi të arsyeshme të transkriptimit në anglisht.

Gjuhët e mbështetura Moonshine

Pyetje të shpeshta

Moonshine është një model i foljes në tekst nga Useful Sensors. STT.ai nuk është aktualisht duke përdorur Moonshine — kjo faqe është informacion referues për modelin. Për transkriptimin në STT.ai, zgjedhësi i modelit ofron familjen Whisper (Turbo, Large V3, Medium, Small).

Në standartet e vlerësimit, Moonshine arrin rreth 7.8% të normave të gabimeve të fjalëve. Saktësia në botën reale varet nga cilësia e audios, theksi dhe gjuha; për regjistrime me zhurmë ose theks, prit disa përqindje më të larta WER.

Moonshine nuk është në dispozicion në STT.ai. Kushtet e liçencës së vet rregullojnë se si duhet të përdoret. Niveli i lirë i STT.ai mbulon modelet Whisper që përdorim — 600 minuta për të filluar, pastaj një rifreskim mujor pa pagesë.

Moonshine është lëshuar nën MIT, një licencë e hapur e hapur. Mund të vetë-hostoni Moonshine në hardware-in tuaj ose të përdorni versionin tonë të pritur — të dy janë komercialisht të përdorshëm.

Moonshine suporton 1 gjuhë. Zbulimi automatik zgjedh gjuhën e duhur për shumicën e audiove; mund ta specifikoni gjithashtu manualisht për një rritje të vogël të saktësisë.

Moonshine përpunon audion në rreth 80.0x në kohë reale në GPU-të tona. Një file audio 1 orë përfundon në më pak se 1 minuta; file më të gjatë vënë në radhë dhe njoftohen me email kur përfundojnë.

Moonshine ka parametrat 61M. Modelet më të mëdha priren të jenë më të sakta por më të ngadalshme; STT.ai hosts Moonshine në GPU kështu që numërimi i parametrave nuk ndikon në performancën e anës së klientit.

Moonshine pranon çdo format që suporton STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, dhe të tjerë. Shfaq si TXT, SRT, VTT, DOCX, JSON, ose PDF.

Po. Diarization e folësit punon së bashku me Moonshine për çdo transkriptim - çdo folës është i etiketuar dhe mund t'i riemërtoni ata në editor më pas.

Po. Moonshine punon në mjedisin tonë të menazhuar — audiot përpunohen dhe eleminohen në mënyrë të prezgjedhur dhe nuk përdoren kurrë për trainim pa opsion të hapur. Planet Pro shtojnë kriptimin në anën e klientit për transkriptat në pushim.

Përdor instrumentin compare-stt për të ekzekutuar Moonshine kundër çdo modeli tjetër të suportuar në të njëjtin audio — do të shihni WER, numrin e segmenteve, etiketat e folësve dhe rezultatet e besimit krah-për-krah. Krahasimi Moonshine vs Whisper Large V3 është më i zakonshmi.

Po. Specifiko "moonshine" si parametri i modelit në /v1/transcribe endpoint. Python dhe Node.js SDK përfshijnë shembuj Moonshine. Niveli i API pa pagesë përfshin 100 minuta në muaj.

Po. Sepse Moonshine është i licencuar MIT, mund ta hostosh vetë. Faqja e burimit të hapur të STT.ai-ës përmban listën e projektit dhe peshat. Shumica e ekipeve të prodhimit përdorin versionin tonë të pritur për të kaluar GPU-në, modelin e shkëmbimit dhe operacionet.
Made by @nadermx