Ses Dil Algılayıcı
Hangi dilde konuşulduğunu tespit etmek için kısa bir ses klibi yükleyin.
Dosyanızı buraya bırakın veya göz atmak için tıklayın
Desteklenen formatlar: MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM
Ses dil algılama API'mizi kullanır. Ücretsiz kaydolun daha fazla özellik için.
Ücretsiz · Kayıt gereksiz · %100 istemci tarafı işleme
← Tüm AraçlarSıkça Sorulan Sorular
Sesli dil tarayıcınızda çalışır: URL'yi yapıştırın, bir dosya yükleyin veya mikrofonunuzdan kaydedin. STT.ai AI modelini seçer ve 5 dakika içinde metin çevirisini geri verir. TXT, SRT, VTT, DOCX, JSON veya PDF olarak ihraç edin.
Evet — her ziyaretçi STT.ai'de başlatmak için 600 ücretsiz dakika alır, Sesli dil için diğer herhangi bir iş akışıyla aynı şekilde kullanılabilir. Ayda $5'dan başlayan ücretli planlar daha uzun dosyaları, özel metinleri ve öncelikli kuyruğu kilitlemektedir.
Sesli dil STT.ai'in geri kalanıyla aynı AI modelleri üzerinde çalışır — en iyi modellerimiz temiz konuşmada %95-97 doğruluğa ulaşırlar (benchmarklarda %3-5 Sözcük Hata Oranı). İlk geçiş hedefinizin altındaysa modelleri uçuşa hazır olarak değiştirin.
Sesli dil STT.ai'in 10+ modelinin herhangi birinde çalışabilir — STT.ai Enhanced (en doğru), Whisper Large V3 (99 dil), NVIDIA Canary (#1 WER desteklenen langs), Whisper Turbo (hızlı), Moonshine (hafif) ve daha fazlası.
Evet. Her bir transkrip SRT veya VTT olarak ihraç edilir. YouTube, Vimeo, TikTok, VLC ve diğer video oynatıcılarla çalışır. Yazma-altyazılı aracı onları videoya hardsubs olarak yerleştirir.
Evet. Sesli diary otomatik olarak her ses için bir etiket (Hafıza 1, Hafıza 2,...) oluşturur ve bunların ismini iç düzenleyicide değiştirebilirsiniz. Tüm model ve dillerde çalışır.
Çoğu Sesli dil iş 5 dakikadan kısa sürede tamamlanır. 1 saatlik bir ses dosyası en hızlı modellerimizle genellikle 2-3 dakikada tamamlanır. Hız seçilen modele ve mevcut GPU yüküne bağlıdır.
Sesli dil 20+ biçimi kabul eder — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI ve daha fazlası. Çıkış TXT, SRT, VTT, DOCX, JSON veya PDF.
Evet. Sesli dil'a gönderilen ses dosyaları varsayılan olarak işleme alınır ve silinir. Pro planları istemci tarafı şifreleme ekler - STT.ai'in veritabanı hasar görse bile, metinleriniz anahtarınız olmadan okunmaz. Veriler açıkça katılma olmadan model eğitimi için asla kullanılmaz.
Evet. STT.ai Python ve Node.js SDK'ları ile bir REST API'si, Claude ve Cursor için bir MCP sunucusu sunuyor - hepsi Sesli dil iş akışlarında kullanılabilir.
Evet. Her makale, kelimeleri düzelttiğiniz, konuşmacıları yeniden adlandırdığınız, zaman damgalarını ayarladığınız ve notlar eklediğiniz iç düzenleyicide açılır. Tüm değişiklikler otomatik olarak kaydedilir.
Her bir transkrip eşsiz bir paylaşılabilir URL alır. E-posta için DOCX veya PDF'ye ihraç edilir. Pro planları şifre ile korunan ve kalıcı bağlantılar ekler - müşteri çalışması için yararlı.
STT.ai, YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast ev sahipleri ve daha fazlası dahil olmak üzere 1.300+ platformu yönetir. URL transkripsiyonu sadece halka açık içerikle çalışır - DRM-koruyucu kaynaklar transkripsiyon yapılamaz.