Moonshine

STT.ai આ મોડેલ ચલાવી શકતું નથી. આ પાનું તેના વિશે સંદર્ભ જાણકારી છે. મોડેલો સાથે ટ્રાન્સક્રિપ્ટ કરો કે જે આપણે ચલાવીએ છીએ →
7.8%
WER
1
ભાષાઓ
80.0x
ઝડપ
MIT
લાઇસન્સ

વિશે Moonshine

Moonshine એ ખૂબ જ સંકુચિત સ્ત્રોત-સમર્પિત પર્યાવરણો માટે ડિઝાઇન કરેલ દ્રષ્ટિ-થી-લખાણ મોડેલ છે. માત્ર 61M પરિમાણો પર, તે Raspberry Pi જેવા એજ ઉપકરણો પર અસરકારક રીતે ચલાવે છે જ્યારે યોગ્ય અંગ્રેજી અનુવાદ ચોકસાઈ જાળવી રાખે છે.

આના દ્વારા આધારિત ભાષાઓ Moonshine

મોડેલ જાણકારી
  • પૂરૂં પાડનારUseful Sensors
  • આર્કિટેક્ચર-
  • લાઇસન્સMIT
  • સુધારેલMar 2026

વારંવાર પૂછાતા પ્રશ્નો

Moonshine એ Useful Sensors દ્દારા બોલી-થી-લખાણ મોડેલ છે. STT.ai હાલમાં Moonshine ચલાવી રહ્યું નથી - આ પાનું મોડેલ વિશે સંદર્ભ જાણકારી છે. STT.ai પર લખાણ બદલવા માટે, મોડેલ પસંદ કરનાર Whisper કુટુંબ (Turbo, Large V3, Medium, Small) પ્રદાન કરે છે.

પ્રમાણભૂત બેન્ચમાર્ક પર, Moonshine એ 7.8% શબ્દ ભૂલ દરને આસપાસ મેળવે છે. વાસ્તવિક-વિશ્વની ચોકસાઈ ઓડિયો ગુણવત્તા, ઉચ્ચારણ અને ભાષા પર આધારિત છે; ધુમાડાવાળા અથવા ઉચ્ચારણવાળા રેકોર્ડિંગ માટે, થોડા ટકા પોઇન્ટ્સ ઊંચા WER ની અપેક્ષા રાખો.

Moonshine STT.ai પર ઉપલબ્ધ નથી. તેની પોતાની લાઇસન્સ શરતો તેને તમે જ ચલાવો તે નિયંત્રિત કરે છે. STT.ai ની મુક્ત સ્તરની વિસ્પર મોડેલોને આવરી લે છે જે આપણે ચલાવીએ છીએ - શરૂ કરવા માટે 600 મિનિટ, પછી મહિનાના મુક્ત ટોચ-અપ.

Moonshine MIT ની નીચે બહાર પાડવામાં આવે છે, એક પરવાનગી આપતી ઓપન-સોર્સ લાઇસન્સ. તમે તમારા પોતાના હાર્ડવેરમાં Moonshine ને સ્વયં-હોસ્ટ કરી શકો છો અથવા અમારી હોસ્ટ કરેલ આવૃત્તિનો ઉપયોગ કરી શકો છો - બંને વાણિજ્યિક રીતે ઉપયોગી છે.

Moonshine 1 ભાષાઓને આધાર આપે છે. આપમેળે-શોધ એ મોટાભાગના ઓડિયો માટે સાચી ભાષા પસંદ કરે છે; તમે તેને નાની ચોકસાઈ માટે જાતે પણ સ્પષ્ટ કરી શકો છો.

Moonshine ઓડિયો પ્રક્રિયાઓ અમારા GPUs પર 80.0x વાસ્તવિક સમય પર. 1-કલાકની ઓડિયો ફાઈલ 1 મિનિટમાં સમાપ્ત થાય છે; લાંબી ફાઈલો કતારમાં અને જ્યારે પૂર્ણ થાય ત્યારે ઈમેઈલ દ્વારા સૂચિત કરે છે.

Moonshine પાસે 61M પરિમાણો છે. મોટા મોડેલો વધુ ચોક્કસ હોય છે પરંતુ ધીમા; STT.ai GPU પર Moonshine યજમાન છે તેથી પરિમાણ ગણતરી તમારી ક્લાયન્ટ-સાઇડ કાર્યક્ષમતા અસર કરતી નથી.

Moonshine દરેક બંધારણને સ્વીકારે છે કે જે STT.ai આધાર આપે છે — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, અને અન્ય. આઉટપુટ TXT, SRT, VTT, DOCX, JSON, અથવા PDF તરીકે.

હા. સ્પીકર ડેટાબેઝ દરેક અનુવાદ માટે Moonshine ની સાથે ચાલે છે - દરેક સ્પીકર ને લેબલ કરેલ છે અને તમે પછી સંપાદકમાં તેનું નામ બદલી શકો છો.

હા. Moonshine અમારા સંચાલિત વાતાવરણમાં ચાલે છે - ઓડિયો મૂળભૂત રીતે પ્રક્રિયા કરેલ છે અને કાઢી નાખવામાં આવે છે અને સ્પષ્ટ રીતે પસંદગી કર્યા વિના તાલીમ માટે ક્યારેય વપરાય નહિં. પ્રો યોજનાઓ અસ્થિર ટ્રાન્સક્રિપ્ટ્સ માટે ક્લાયન્ટ-સાઇડ એનક્રિપ્શન ઉમેરે છે.

Moonshine ને કોઈપણ અન્ય આધારભૂત મોડેલ સામે એ જ ઓડિયો પર ચલાવવા માટે સરખામણી-stt સાધનનો ઉપયોગ કરો - તમે WER, સેગમેન્ટ ગણતરી, સ્પીકર લેબલ્સ, અને વિશ્વાસ સ્કોર બાજુ-બે-બાજુ જોશો. Moonshine વિ Whisper Large V3 સરખામણી સૌથી સામાન્ય રીતે ચલાવે છે.

હા. /v1/transcribe અંતિમબિંદુ પર મોડેલ પરિમાણ તરીકે "moonshine" ને સ્પષ્ટ કરો. Python અને Node.js SDKs Moonshine ઉદાહરણો સમાવે છે. મુક્ત API સ્તરમાં 100 મિનિટ/મહિના સમાવે છે.

હા. કારણ કે Moonshine એ MIT-લાઇસન્સ થયેલ છે, તમે તેને સ્વયં-હોસ્ટ કરી શકો છો. STT.ai નું ઓપન-સોર્સ પાનું પ્રોજેક્ટ રેપો અને વજનોની યાદી કરે છે. મોટાભાગના ઉત્પાદન ટીમો GPU ખરીદી, મોડેલ સ્વેપ અને ઓપસને છોડવા માટે અમારી યજમાન આવૃત્તિ વાપરે છે.