Özgür Sesli Mesajlaşma Online

Yapay zeka destekli çeviri ile konuşmayı metne dönüştürün. Ses dosyaları yükleyin, mikrofonunuzdan kaydedin veya URL'yi yapıştırın. 100'den fazla dil, 10'dan fazla model, %98'den fazla doğruluk.

Halka açık ses ve video ile çalışır. DRM-koruyucu içerik desteklenmez.

İyileştirme için yükselt
Özel transkript
Çeviri ile sohbet
Pro ile kilidi aç →
Dosyayı buraya bırak veya taramak için tıkla
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — 2GB'a kadar
İyileştirme için yükselt
Özel transkript
Çeviri ile sohbet
Pro ile kilidi aç →
İyileştirme için yükselt
Kayıt: 0:00
Gerçek zamanlı Balmumu (anlık)
İyileştirilmiş Fısılda (kesin)
Halka açık bağlantılar: 24 saat, sadece metin · Kayıt ol 7d + ses için · Pro özel bağlantılar için

Gerçek zamanlı konuşmadan metne. AI konuşurken otomatik olarak düzeltir — doğruluk konuşma uzunlaştıkça iyileşir.

Önce mikrofonu test et
❤️ STT.ai'yi seviyor musunuz?
Bedava çevirilerini kullandın.

600 dakika almak için ücretsiz kayıt olun veya binlerce daha fazlası için ayda 5 dolardan yükseltin.

Günde 10 dakika ücretsiz 600 dakika ücretsiz Kredi kartı yok. Şifrelenmiş
Ücretsiz kayıt olun →

1. Ses kaydını yükleyin

Ses veya video dosyası yükleyin, URL yapıştırın veya mikrofondan kayıt yapın.

2. Yapay zeka konuşmayı metne dönüştürür

10'dan fazla yapay zeka modeli arasından seçin. Konuşmacı tespiti ve otomatik dil algılama dahil.

3. Transkriptinizi dışa aktarın

6 formatta indirin. Ses oynatmalı transkript bağlantılarını paylaşın.

Supported Speech Input Formats

Ready to convert speech to text?

Ücretsiz başla →

Sıkça Sorulan Sorular

Konuşmadan metne (aynı zamanda konuşma tanıma veya ASR olarak da adlandırılır) konuşulan ses otomatik olarak yazılı kelimelere dönüştürülür. STT.ai, kayıtlarınızı sesleri dinleyen ve zaman damgaları ve konuşmacı etiketleriyle düzenleyici metin çıkaran bir AI modeli aracılığıyla çalıştırıyor - yazma gerekmiyor.

Akustik bir model ses dalga biçimini fonemlere haritalar, sonra bir dil modeli en muhtemel kelimeler ve noktalama işaretlerine monte eder. STT.ai bunu Whisper Large V3 ve NVIDIA Canary gibi modellerle GPU üzerinde yapar, böylece bir saatlik bir kayıt genellikle 2-3 dakikada yapılır.

Evet, her ziyaretçi ilk dosyanız için kayıt olmak zorunda olmadan 600 dakika ücretsiz başlar. Ücretli planlar ayda 5 dolar ile başlar ve daha uzun dosyalar, özel metinler ve öncelikli işlemler ekler.

Temiz konuşmada en iyi modellerimiz %95-97 doğruluğa ulaşırlar (benchmarklarda %3-5 kelime hata oranı). arka plan gürültüsü, ağır aksanlar, karşılıklı konuşmalar veya düşük bit hızında sesle doğruluk düşer — uygun bir mikrofon ve sessiz bir oda en büyük farkı yapar.

Evet. Mikrofonuna konuş ve STT.ai canlı-transkripsiyon aracı ile canlı olarak transkripsiyonu akıtır. Konuştuğunda kelime kelime ihtiyacın yoksa, grup olarak transkripsiyon için tamamlanmış bir kayıt yükleyebilirsin.

STT.ai 100'den fazla dil tanır ve çoğu ses için konuşulan dili otomatik olarak tespit eder. Ayrıca, küçük bir doğruluk yükseltmesi için dili el ile ayarlayabilirsiniz ve karışık dil kayıtları klip ortasında geçişle yönetilir.

Evet. Hoparlör diarizasyonu her sesi etiketler (Hoparlör 1, Hoparlör 2,...) ve bunları düzenleyicide yeniden adlandırabilirsiniz. Bu her desteklenen model ve dilde çalışır.

STT.ai MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM ve AVI dahil olmak üzere 20+ formatı kabul eder.TXT, SRT, VTT, DOCX, JSON veya PDF'ye çıkışı.

Konuşmadan metne, söylenen şeyi kelimelere çevirir; ses tanıma (konuşmacı tanıma) bunu KIMIN söylediğini belirler. STT.ai her ikisini de yapar - transkripsiyon ve konuşmacı diarizasyonu - ancak bu terimler farklı görevleri tanımlamaktadır.

Evet. Ses varsayılan olarak işleme ve silme işlemine tabi tutulur. Pro planları istemci tarafı şifreleme ekler, bu yüzden metinler anahtarınız olmadan okunmaz, STT.ai'e kadar bile. Verileriniz açıkça kabul etmeden model eğitimi için asla kullanılmaz.

Evet. STT.ai Python ve Node.js SDK'ları ile REST API'ye sahiptir ve Claude ve Cursor için bir MCP sunucusu vardır. Ücretsiz API katmanı ayda 100 dakika içerir, bunun ötesinde saniyede faturalandırmayla.

Evet. Her bir transkrip, yanlış duyulan kelimeleri düzelttiğiniz, konuşmacıların adını değiştirdiğiniz, zaman damgalarını ayarladığınız ve notlar eklediğiniz bir iç düzenleyicide açılır. Düzenlemeler her bir ihracat biçimindevam eder.