Özgür Sesli Mesajlaşma Online
Yapay zeka destekli çeviri ile konuşmayı metne dönüştürün. Ses dosyaları yükleyin, mikrofonunuzdan kaydedin veya URL'yi yapıştırın. 100'den fazla dil, 10'dan fazla model, %98'den fazla doğruluk.
1. Ses kaydını yükleyin
Ses veya video dosyası yükleyin, URL yapıştırın veya mikrofondan kayıt yapın.
2. Yapay zeka konuşmayı metne dönüştürür
10'dan fazla yapay zeka modeli arasından seçin. Konuşmacı tespiti ve otomatik dil algılama dahil.
3. Transkriptinizi dışa aktarın
6 formatta indirin. Ses oynatmalı transkript bağlantılarını paylaşın.
Speech to Text Models
Choose the AI model that fits your needs — or let us pick the best one.
Speech to Text in 100+ Languages
Speech to Text Use Cases
Ready to convert speech to text?
Ücretsiz başla →Sıkça Sorulan Sorular
Konuşmadan metne (aynı zamanda konuşma tanıma veya ASR olarak da adlandırılır) konuşulan ses otomatik olarak yazılı kelimelere dönüştürülür. STT.ai, kayıtlarınızı sesleri dinleyen ve zaman damgaları ve konuşmacı etiketleriyle düzenleyici metin çıkaran bir AI modeli aracılığıyla çalıştırıyor - yazma gerekmiyor.
Akustik bir model ses dalga biçimini fonemlere haritalar, sonra bir dil modeli en muhtemel kelimeler ve noktalama işaretlerine monte eder. STT.ai bunu Whisper Large V3 ve NVIDIA Canary gibi modellerle GPU üzerinde yapar, böylece bir saatlik bir kayıt genellikle 2-3 dakikada yapılır.
Evet, her ziyaretçi ilk dosyanız için kayıt olmak zorunda olmadan 600 dakika ücretsiz başlar. Ücretli planlar ayda 5 dolar ile başlar ve daha uzun dosyalar, özel metinler ve öncelikli işlemler ekler.
Temiz konuşmada en iyi modellerimiz %95-97 doğruluğa ulaşırlar (benchmarklarda %3-5 kelime hata oranı). arka plan gürültüsü, ağır aksanlar, karşılıklı konuşmalar veya düşük bit hızında sesle doğruluk düşer — uygun bir mikrofon ve sessiz bir oda en büyük farkı yapar.
Evet. Mikrofonuna konuş ve STT.ai canlı-transkripsiyon aracı ile canlı olarak transkripsiyonu akıtır. Konuştuğunda kelime kelime ihtiyacın yoksa, grup olarak transkripsiyon için tamamlanmış bir kayıt yükleyebilirsin.
STT.ai 100'den fazla dil tanır ve çoğu ses için konuşulan dili otomatik olarak tespit eder. Ayrıca, küçük bir doğruluk yükseltmesi için dili el ile ayarlayabilirsiniz ve karışık dil kayıtları klip ortasında geçişle yönetilir.
Evet. Hoparlör diarizasyonu her sesi etiketler (Hoparlör 1, Hoparlör 2,...) ve bunları düzenleyicide yeniden adlandırabilirsiniz. Bu her desteklenen model ve dilde çalışır.
STT.ai MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM ve AVI dahil olmak üzere 20+ formatı kabul eder.TXT, SRT, VTT, DOCX, JSON veya PDF'ye çıkışı.
Konuşmadan metne, söylenen şeyi kelimelere çevirir; ses tanıma (konuşmacı tanıma) bunu KIMIN söylediğini belirler. STT.ai her ikisini de yapar - transkripsiyon ve konuşmacı diarizasyonu - ancak bu terimler farklı görevleri tanımlamaktadır.
Evet. Ses varsayılan olarak işleme ve silme işlemine tabi tutulur. Pro planları istemci tarafı şifreleme ekler, bu yüzden metinler anahtarınız olmadan okunmaz, STT.ai'e kadar bile. Verileriniz açıkça kabul etmeden model eğitimi için asla kullanılmaz.
Evet. STT.ai Python ve Node.js SDK'ları ile REST API'ye sahiptir ve Claude ve Cursor için bir MCP sunucusu vardır. Ücretsiz API katmanı ayda 100 dakika içerir, bunun ötesinde saniyede faturalandırmayla.
Evet. Her bir transkrip, yanlış duyulan kelimeleri düzelttiğiniz, konuşmacıların adını değiştirdiğiniz, zaman damgalarını ayarladığınız ve notlar eklediğiniz bir iç düzenleyicide açılır. Düzenlemeler her bir ihracat biçimindevam eder.