Moonshine

STT.ai δεν τρέχει αυτό το μοντέλο Τρανσέρβερ με τα μοντέλα που τρέχουμε →
7.8%
WER
1
Γλώσσες
80.0x
Ταχύτητα
MIT
Άδεια

Σχετικά Moonshine

Το Moonshine είναι ένα εξαιρετικά συμπαγές μοντέλο ομιλίας προς κείμενο σχεδιασμένο για περιβάλλοντα με περιορισμούς πόρων. Σε μόνο 61M παραμέτρους, λειτουργεί αποτελεσματικά σε συσκευές ακμές όπως Raspberry Pi διατηρώντας παράλληλα λογική αγγλική ακρίβεια μεταγραφής.

Γλώσσες που υποστηρίζονται από Moonshine

Υπόδειγμα πληροφοριών
  • ΠρομηθευτήςUseful Sensors
  • Αρχιτεκτονική-
  • ΆδειαMIT
  • ΕνημέρωσηMar 2026

Συχνές Ερωτήσεις

Moonshine is a speech-to-text model by Useful Sensors. STT.ai does not currently run Moonshine — this page is reference information about the model. For transcription on STT.ai, the model picker offers the Whisper family (Turbo, Large V3, Medium, Small).

Στα πρότυπα σημεία αναφοράς, Moonshine επιτυγχάνει περίπου 7.8% Word Error Rate. Ακρίβεια σε πραγματικό κόσμο εξαρτάται από την ποιότητα ήχου, την προφορά, και τη γλώσσα? για θορυβώδη ή τονισμένη ηχογραφήσεις, αναμένουν μερικές ποσοστιαίες μονάδες υψηλότερη WER.

Moonshine δεν είναι διαθέσιμη στις STT.ai. Οι δικοί του όροι άδειας λειτουργίας του μόνοι σας. STT.ai δωρεάν βαθμίδα καλύπτει τα μοντέλα Whisper κάνουμε τρέξει 600 λεπτά για να ξεκινήσετε, στη συνέχεια, ένα μηνιαίο δωρεάν top-up.

Moonshine κυκλοφορεί κάτω από MIT, μια ανεκτική άδεια ανοικτού κώδικα. Μπορείτε να αυτο-φιλοξενήσετε Moonshine στο δικό σας υλικό ή να χρησιμοποιήσετε μας φιλοξενείται έκδοση και τα δύο είναι εμπορικά χρησιμοποιήσιμα.

Moonshine υποστηρίζει 1 γλώσσες. Auto-detection επιλέγει τη σωστή γλώσσα για τους περισσότερους ήχους? μπορείτε επίσης να το καθορίσετε χειροκίνητα για ένα μικρό ανελκυστήρα ακρίβειας.

Moonshine διαδικασίες ήχου σε περίπου 80.0x σε πραγματικό χρόνο στις GPUs μας. Ένα αρχείο ήχου 1 ώρας τελειώνει σε λιγότερο από 1 λεπτά; μεγαλύτερη ουρά αρχείων και να ειδοποιήσει με email όταν γίνει.

Moonshine έχει 61M παραμέτρους. Μεγαλύτερα μοντέλα τείνουν να είναι πιο ακριβή αλλά πιο αργά; STT.ai φιλοξενεί Moonshine σε GPU έτσι ώστε η μέτρηση παραμέτρου δεν επηρεάζει τις επιδόσεις του πελάτη-πλευρά σας.

Το Moonshine δέχεται κάθε μορφή STT.ai υποστηρίζει MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, και άλλα. Έξοδος ως TXT, SRT, VTT, DOCX, JSON, ή PDF.

Ναι. Διαχωρισμός ομιλητών τρέχει παράλληλα με Moonshine για κάθε μεταγραφή. Κάθε ομιλητής φέρει την ετικέτα και μπορείτε να τα μετονομάσετε στον επεξεργαστή στη συνέχεια.

Ναι. Moonshine τρέχει στο διαχειριστικό περιβάλλον μας Ο ήχος επεξεργάζεται και διαγράφεται από προεπιλογή και δεν χρησιμοποιείται ποτέ για την εκπαίδευση χωρίς ρητή opt-in. Pro σχέδια προσθέτουν κρυπτογράφηση client-side για τα πρακτικά σε κατάσταση ηρεμίας.

Χρησιμοποιήστε το εργαλείο σύγκρισης-stt για να τρέξει Moonshine με οποιοδήποτε άλλο υποστηριζόμενο μοντέλο για το ίδιο ακουστικό ~ θα δείτε WER, section μετρώντας, ετικέτες ηχείων, και βαθμολογία εμπιστοσύνης δίπλα-δίπλα. Η σύγκριση Moonshine vs Whisper Large V3 είναι η πιο συχνά τρέχει.

Ναι. Καθορίστε το "moonshine" ως την παράμετρο του μοντέλου στο τελικό σημείο /v1/trancribe. Python και Node.js SDKs περιλαμβάνουν Moonshine παραδείγματα. Free API βαθμίδα περιλαμβάνει 100 λεπτά/μήνα.

Ναι. Επειδή το Moonshine είναι MIT-licensed, μπορείτε να το αυτο-φιλοξενήσετε. STT.ai ανοιχτής πηγής σελίδα του αναφέρει το repo του έργου και τα βάρη. Οι περισσότερες ομάδες παραγωγής χρησιμοποιούν την φιλοξενούμενη έκδοση μας για να παραλείψετε προμήθειες GPU, μοντέλα ανταλλαγής, και ops.
Made by @nadermx