Hata / Özellik İstek Raporu

Bu ile kopyala Vosk

Name: Vosk
Author: Alpha Cephei

Halka açık ses ve video ile çalışır. DRM-koruyucu içerik desteklenmez.

İyileştirme için yükselt

Özel transkript

Çeviri ile sohbet

Pro ile kilidi aç →

Dosyayı buraya bırak veya taramak için tıkla

MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — 2GB'a kadar

Çoklu dosya yükleme Pro ile

İyileştirme için yükselt

Özel transkript

Çeviri ile sohbet

Pro ile kilidi aç →

İyileştirme için yükselt

Gerçek zamanlı konuşmadan metne. AI konuşurken otomatik olarak düzeltir — doğruluk konuşma uzunlaştıkça iyileşir.

Önce mikrofonu test et

Günde 10 dakika ücretsiz 600 dakika ücretsiz Kredi kartı yok. Şifrelenmiş

Ücretsiz kayıt olun →

12.0%

WER

Dilleri

100.0x

Hız

Apache 2.0

Lisans

Hakkında Vosk

Vosk, İnternet bağlantısı olmadan çalışan bir çevrimdışı konuşma tanıma araç setidir. Mobil cihazlarda, Raspberry Pi'de ve herhangi bir platformda çalışabilecek kompakt modellerle 20'den fazla dil destekler. Kaldi ve Zipformer mimarileri üzerine inşa edilmiştir.

Desteklenen Diller Vosk

İngilizce

İspanyolca

Fransızca

Almanca

Çince

Japonca

Korece

Portekizce

Arapça

Hintçe

Rusça

İtalyanca

Felemenkçe

Türkçe

Lehçe

İsveççe

Endonezce

Vietnamca

Çekçe

Yunanca

Model Bilgisi

SağlayıcıAlpha Cephei
Mimarlık-
LisansApache 2.0
GüncellendiMar 2026

İlgili Modeller

3.2% WER

4.2% WER

5.1% WER

3.5% WER

7.8% WER

Sıkça Sorulan Sorular

Vosk, Alpha Cephei tarafından geliştirilen bir konuşma-metin modelidir. STT.ai, Vosk'e GPU altyapımızda ev sahipliği yapmaktadır, böylece kendi donanımınızı sağlamadan kullanabilirsiniz - ses veya video yükleyin ve model seçicisinden Vosk'i seçin.

Standart referanslarda, Vosk yaklaşık %12.0 kelime hata oranına ulaşmıştır.Gerçek dünya doğruluğu ses kalitesine, aksan ve dile bağlıdır; gürültülü veya aksanlı kayıtlar için, birkaç yüzde puan daha yüksek WER bekleyin.

Vosk STT.ai'in ücretsiz seviyesinde çalışır - her ziyaretçi ücretsiz olarak başlatmak için 600 dakika alır.Ödemeli planlar dosya başına daha uzun sınırlar, özel transkriptler ve öncelikli kuyruk ekler.

Vosk, Apache 2.0, bir açık kaynak lisansı altında yayınlanmıştır. Vosk'i kendi donanımınızda kendi kendinize konumlandırabilir veya bizim konumlandırılmış sürümümüzü kullanabilirsiniz - her ikisi de ticari olarak kullanılabilir.

Vosk 20 dillerini destekler. Otomatik tespit çoğu ses için doğru dili seçer; küçük bir doğruluk artırımı için el ile de belirtebilirsiniz.

Vosk, GPU'larımızda yaklaşık 100.0x gerçek zamanlı ses işleme hızına sahiptir. 1 saatlik bir ses dosyası 1 dakikanın altında tamamlanır; daha uzun dosyalar kuyruğa alınır ve bittiğinde e-posta ile bildirim yapılır.

Vosk'in 50M parametresi vardır. Daha büyük modellerin daha doğru ama daha yavaş olmasına eğilim vardır; STT.ai GPU'da Vosk'e ev sahipliği yapar bu yüzden parametre sayısı istemci taraf performansınızı etkilemez.

Vosk, STT.ai'in desteklediği her biçimi kabul eder - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI ve diğerleri. Çıkış TXT, SRT, VTT, DOCX, JSON veya PDF olarak.

Evet, her bir transkrip için Vosk'in yanında konuşanların diarizasyonu çalışıyor. Her bir konuşan etiketleniyor ve sonradan editöründe isimlerini değiştirebilirsiniz.

Evet. Vosk bizim yönetilen ortamımızda çalışıyor - ses işleme ve varsayılan olarak silinir ve açıkça opt-in olmadan eğitim için asla kullanılmaz. Pro planları, bekleyen transkripler için istemci tarafı şifreleme ekler.

Aynı ses üzerinde Vosk'i diğer desteklenen modellerle karşılaştırmak için compare-stt aracı kullanın - WER, segment sayısını, hoparlör etiketlerini ve güven puanlarını yan yana göreceksiniz. Vosk vs Whisper Large V3 karşılaştırması en sık yapılandır.

Evet. /v1/transcribe son noktasında model parametresi olarak "vosk"yi belirtin. Python ve Node.js SDK'ları Vosk örneklerini içerir. Ücretsiz API katmanı ayda 100 dakika içerir.

Evet. Vosk Apache 2.0 lisanslı olduğu için kendine ev sahipliği yapabilirsin. STT.ai'in açık kaynak sayfası proje deposunu ve ağırlıklarını listeler. Çoğu üretim ekibi GPU satın alımı, model değişimi ve operasyonları atlamak için ev sahipliği yaptığımız sürümü kullanır.

Bu ile kopyala Vosk

Hakkında Vosk

Desteklenen Diller Vosk

Model Bilgisi

İlgili Modeller

Sıkça Sorulan Sorular

Vosk nedir?

Vosk ne kadar doğru?

Vosk ücretsiz mi?

Vosk hangi lisansı kullanıyor?

Vosk kaç dil destekliyor?

Vosk ne kadar hızlı?

Vosk modeli ne kadar büyük?

Vosk hangi ses formatlarını kopyalayabilir?

Vosk çoklu hoparlörleri tespit ediyor mu?

Vosk kullanırken verilerim gizli mi?

Vosk diğer STT modelleriyle nasıl karşılaştırılır?

API üzerinden Vosk'i kullanabilir miyim?

Vosk'i kendi sunucumda çalıştırabilir miyim?