Hata / Özellik İstek Raporu

Bu ile kopyala Whisper Large V3

Name: Whisper Large V3
Author: OpenAI

Halka açık ses ve video ile çalışır. DRM-koruyucu içerik desteklenmez.

İyileştirme için yükselt

Özel transkript

Çeviri ile sohbet

Pro ile kilidi aç →

Dosyayı buraya bırak veya taramak için tıkla

MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — 2GB'a kadar

Çoklu dosya yükleme Pro ile

İyileştirme için yükselt

Özel transkript

Çeviri ile sohbet

Pro ile kilidi aç →

İyileştirme için yükselt

Gerçek zamanlı konuşmadan metne. AI konuşurken otomatik olarak düzeltir — doğruluk konuşma uzunlaştıkça iyileşir.

Önce mikrofonu test et

Günde 10 dakika ücretsiz 600 dakika ücretsiz Kredi kartı yok. Şifrelenmiş

Ücretsiz kayıt olun →

4.2%

WER

Dilleri

8.0x

Hız

MIT

Lisans

Hakkında Whisper Large V3

Whisper Large V3, OpenAI'nin açık kaynaklı konuşma tanıma modelinin ana modelidir. 1.55 milyar parametresiyle, 99 dilde olağanüstü doğruluk sunuyor. 680.000 saatlik çok dilli ses verisiyle eğitilmiş bir transformatör kodlayıcı-kod çözücü mimari kullanıyor.

Desteklenen Diller Whisper Large V3

İngilizce

İspanyolca

Fransızca

Almanca

Çince

Japonca

Korece

Portekizce

Arapça

Hintçe

Rusça

İtalyanca

Felemenkçe

Türkçe

Lehçe

İsveççe

Endonezce

Tayca

Vietnamca

Çekçe

Yunanca

Rumence

Macarca

İbranice

Danca

Fince

Norveççe

Ukraynaca

Malayca

Bengalce

Model Bilgisi

SağlayıcıOpenAI
Mimarlık-
LisansMIT
GüncellendiMar 2026

İlgili Modeller

3.2% WER

5.1% WER

3.5% WER

7.8% WER

3.0% WER

Sıkça Sorulan Sorular

Whisper Large V3, OpenAI tarafından geliştirilen bir konuşma-metin modelidir. STT.ai, Whisper Large V3'e GPU altyapımızda ev sahipliği yapmaktadır, böylece kendi donanımınızı sağlamadan kullanabilirsiniz - ses veya video yükleyin ve model seçicisinden Whisper Large V3'i seçin.

Standart referanslarda, Whisper Large V3 yaklaşık %4.2 kelime hata oranına ulaşmıştır.Gerçek dünya doğruluğu ses kalitesine, aksan ve dile bağlıdır; gürültülü veya aksanlı kayıtlar için, birkaç yüzde puan daha yüksek WER bekleyin.

Whisper Large V3 STT.ai'in ücretsiz seviyesinde çalışır - her ziyaretçi ücretsiz olarak başlatmak için 600 dakika alır.Ödemeli planlar dosya başına daha uzun sınırlar, özel transkriptler ve öncelikli kuyruk ekler.

Whisper Large V3, MIT, bir açık kaynak lisansı altında yayınlanmıştır. Whisper Large V3'i kendi donanımınızda kendi kendinize konumlandırabilir veya bizim konumlandırılmış sürümümüzü kullanabilirsiniz - her ikisi de ticari olarak kullanılabilir.

Whisper Large V3 99 dillerini destekler. Otomatik tespit çoğu ses için doğru dili seçer; küçük bir doğruluk artırımı için el ile de belirtebilirsiniz.

Whisper Large V3, GPU'larımızda yaklaşık 8.0x gerçek zamanlı ses işleme hızına sahiptir. 1 saatlik bir ses dosyası 7 dakikanın altında tamamlanır; daha uzun dosyalar kuyruğa alınır ve bittiğinde e-posta ile bildirim yapılır.

Whisper Large V3'in 1.55B parametresi vardır. Daha büyük modellerin daha doğru ama daha yavaş olmasına eğilim vardır; STT.ai GPU'da Whisper Large V3'e ev sahipliği yapar bu yüzden parametre sayısı istemci taraf performansınızı etkilemez.

Whisper Large V3, STT.ai'in desteklediği her biçimi kabul eder - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI ve diğerleri. Çıkış TXT, SRT, VTT, DOCX, JSON veya PDF olarak.

Evet, her bir transkrip için Whisper Large V3'in yanında konuşanların diarizasyonu çalışıyor. Her bir konuşan etiketleniyor ve sonradan editöründe isimlerini değiştirebilirsiniz.

Evet. Whisper Large V3 bizim yönetilen ortamımızda çalışıyor - ses işleme ve varsayılan olarak silinir ve açıkça opt-in olmadan eğitim için asla kullanılmaz. Pro planları, bekleyen transkripler için istemci tarafı şifreleme ekler.

Aynı ses üzerinde Whisper Large V3'i diğer desteklenen modellerle karşılaştırmak için compare-stt aracı kullanın - WER, segment sayısını, hoparlör etiketlerini ve güven puanlarını yan yana göreceksiniz. Whisper Large V3 vs Whisper Large V3 karşılaştırması en sık yapılandır.

Evet. /v1/transcribe son noktasında model parametresi olarak "whisper-large-v3"yi belirtin. Python ve Node.js SDK'ları Whisper Large V3 örneklerini içerir. Ücretsiz API katmanı ayda 100 dakika içerir.

Evet. Whisper Large V3 MIT lisanslı olduğu için kendine ev sahipliği yapabilirsin. STT.ai'in açık kaynak sayfası proje deposunu ve ağırlıklarını listeler. Çoğu üretim ekibi GPU satın alımı, model değişimi ve operasyonları atlamak için ev sahipliği yaptığımız sürümü kullanır.

Bu ile kopyala Whisper Large V3

Hakkında Whisper Large V3

Desteklenen Diller Whisper Large V3

Model Bilgisi

İlgili Modeller

Sıkça Sorulan Sorular

Whisper Large V3 nedir?

Whisper Large V3 ne kadar doğru?

Whisper Large V3 ücretsiz mi?

Whisper Large V3 hangi lisansı kullanıyor?

Whisper Large V3 kaç dil destekliyor?

Whisper Large V3 ne kadar hızlı?

Whisper Large V3 modeli ne kadar büyük?

Whisper Large V3 hangi ses formatlarını kopyalayabilir?

Whisper Large V3 çoklu hoparlörleri tespit ediyor mu?

Whisper Large V3 kullanırken verilerim gizli mi?

Whisper Large V3 diğer STT modelleriyle nasıl karşılaştırılır?

API üzerinden Whisper Large V3'i kullanabilir miyim?

Whisper Large V3'i kendi sunucumda çalıştırabilir miyim?