Transcrever com Moonshine
7.8%
WER
1
Languages
80.0x
Speed
MIT
License
Sobre Moonshine
Moonshine is an extremely compact speech-to-text model designed for resource-constrained environments. At only 61M parameters, it runs efficiently on edge devices like Raspberry Pi while maintaining reasonable English transcription accuracy.
Idiomas suportados por Moonshine
Model Info
- ProviderUseful Sensors
- Architecture-
- LicenseMIT
- UpdatedMar 2026
Perguntas frequentes
Moonshine é um modelo de fala a texto por Useful Sensors. STT.ai hospeda Moonshine em nossa infraestrutura GPU para que você possa usá-lo sem providenciar seu próprio hardware — carregar áudio ou vídeo e escolher Moonshine do seletor de modelos.
Nas referências padrão, Moonshine atinge cerca de 8801% da taxa de erro do Word. A precisão do mundo real depende da qualidade, acento e linguagem do áudio; para gravações ruidosas ou acentuadas, esperam alguns pontos percentuais mais altos WER.
Moonshine corre no nível livre de STT.ai — cada visitante recebe 600 minutos/mes sem custo. Planos pagos adicionam mais limites por arquivo, transcrições privadas e fila de espera prioritária.
Moonshine é lançado sob MIT, uma licença permissiva de código aberto. Você pode auto-hoste Moonshine em seu próprio hardware ou usar a nossa versão hospedada — ambos são comercialmente utilizáveis.
Moonshine suporta 1 idiomas. Auto-detecção escolhe a linguagem certa para a maioria do áudio; você também pode especificar manualmente para um pequeno elevador de precisão.
Moonshine processa áudio a cerca de 80.0x em tempo real em nosso GPUs. Um arquivo de áudio de 1 hora termina em menos de 1 minutos; arquivos mais longos cola e notifica por e-mail quando feito.
Moonshine tem 61M parâmetros. Os modelos mais grandes tendem a ser mais precisos mas mais lentos; STT.ai hosts Moonshine na GPU para que a contagem de parâmetros não afecte o seu desempenho do lado do cliente.
Moonshine aceita cada formato STT.ai suportes — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI e outros. Saída como TXT, SRT, VTT, DOCX, JSON ou PDF.
Sim. Diarização do orador corre ao lado de Moonshine para cada transcrição — cada orador é rotulado e você pode renomeá-los no editor depois.
Sim. Moonshine funciona no nosso ambiente gerenciado — áudio é processado e excluído por padrão e nunca usado para treinamento sem opt-in explícito. Pro planos adicionar criptografia do lado do cliente para transcrições no repouso.
Use a ferramenta compar-stt para executar Moonshine contra qualquer outro modelo suportado no mesmo áudio — você verá WER, contagem de segmentos, rótulos de alto-falante e pontuação de confiança lado a lado. A comparação Moonshine vs Whisper Large V3 é a mais comumente executada.
Sim. Especifique "moonshine" como o parâmetro do modelo no ponto final /v1/transcribe. Python e Node.js SDKs incluem Moonshine exemplos. O nível de API gratuito inclui 100 minutos/mes.
Sim. Como Moonshine é MIT-licenciado, você pode hospedá-lo. STT.ai página de código aberto lista o projeto repo e pesos. A maioria das equipes de produção usa a nossa versão hospedada para saltar compras GPU, swaps de modelos e ops.