Moonshine

STT.ai не го извршува овој модел — оваа страница е референтна информација за него. Транкрипувај со моделите кои ги водиме →
7.8%
WER
1
Јазици
80.0x
Брзина
MIT
Лиценца

За Moonshine

Муншајн е екстремно компактен модел за говор-текст дизајниран за ресурси-консултирани околини. Само 61M параметри, работи ефикасно на работни уреди како што е Raspberry Pi, истовремено одржувајќи разумна англиска точност на транскрипцијата.

Јазиците што ги поддржува Moonshine

Инфо за моделот
  • ДоставувачUseful Sensors
  • Архитектура-
  • ЛиценцаMIT
  • АжурираноMar 2026

Често поставувани прашања

Moonshine е модел од говор до текст со Useful Sensors. STT.ai моментално не работи Moonshine — оваа страница е референтна информација за моделот. За транскрипција на STT.ai, моделот на бирачот му нуди на семејството Whisper (Turbo, Big V3, Medium, Small).

Според стандардните стандарди, Moonshine постигнуваат околу 7.8% проценка на грешките на зборовите. Прецизноста на реалниот свет зависи од квалитетот на звукот, акцентот и јазикот; за бучни или акцентирани снимки, очекуваат неколку проценти повисоко од ВЕР.

Moonshine не е достапно на STT.ai. Нејзините сопствени лиценца услови управуваат со него самиот. STT.ai е слободен низа ги покрива моделите на Whisper кои ги извршуваме — 600 минути за почеток, потоа месечно бесплатно топ- up.

Moonshine е ослободен под MIT, попустлива лиценца со отворен извор. Moonshine може да се води на сопствен хардвер или да се користи нашата домаќинска верзија — и двете се комерцијално употребливи.

Moonshine поддржува 1 јазици. Авто- детекција го избира вистинскиот јазик за повеќето аудио; исто така можете рачно да го наведете за малку прецизност.

Moonshine процесира аудио на околу 80.0x во реално време на нашите GPU. 1- часовна аудио датотека завршува за помалку од 8802 минути; подолга редица на датотеки и известува со е- пошта кога ќе биде завршена.

Moonshine има 8802 параметри. Поголемите модели се поточни, но побавни; STT.ai домаќини Moonshine на GPU за броењето на параметрите да не влијае на перформансите на вашиот клиент.

Moonshine го прифаќа секој формат STT.ai потпори — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI и други.

Дијаризирањето на звучникот оди заедно со Moonshine за секоја транскрипција — секој говорник е означен и потоа можете да ги преименувате во уредникот.

Да. Moonshine работи во нашата управувана средина — аудиото е обработено и избришано стандардно и никогаш не се користи за обука без експлицитна опти-ин. Про плановите додаваат енкрипција на страна на клиентот за преписи во мир.

Користете ја алатката споредба-ст за извршување Moonshine против било кој друг поддржан модел на истиот аудио — ќе го видите WER, бројот на сегменти, звучниците и самодоверливите резултати од страна на страна. Поравнувањето Moonshine против Whisper Large V3 е најчесто извршено.

Да. Наведете „ moonshine “ како параметар на моделот на крајната точка / v1/transcribe. Python и Node.js SDKs вклучуваат Moonshine примери. Слободната API низа вклучува 100 минути/месечно.

Бидејќи Moonshine е 8802-лицензирана, можеш да го водиш. STT.ai-те страници со отворен извор ги набројуваат репо и тежини на проектот. Повеќето производствени тимови ја користат нашата домаќинска верзија за да ја прескокнат набавката на ГПУ, размената на модели и опс.
Made by @nadermx