Özgür Yapay Zeka Konuşmadan MetneName

Ses ve videoyu 100'den fazla dilde metin haline çevirin. Çok sayıda Whisper modeli. Konuşmacı tespit. Kayıt gerekmez.

12K
- Yazışmalar.
290.3K
dakikalar kaydedildi
100+
dilleri
70+
özgür araçlar

Halka açık ses ve video ile çalışır. DRM-koruyucu içerik desteklenmez.

İyileştirme için yükselt
Özel transkript
Çeviri ile sohbet
Pro ile kilidi aç →
Dosyayı buraya bırak veya taramak için tıkla
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — 2GB'a kadar
İyileştirme için yükselt
Özel transkript
Çeviri ile sohbet
Pro ile kilidi aç →
İyileştirme için yükselt
Kayıt: 0:00
Gerçek zamanlı Balmumu (anlık)
İyileştirilmiş Fısılda (kesin)
Halka açık bağlantılar: 24 saat, sadece metin · Kayıt ol 7d + ses için · Pro özel bağlantılar için

Gerçek zamanlı konuşmadan metne. AI konuşurken otomatik olarak düzeltir — doğruluk konuşma uzunlaştıkça iyileşir.

Önce mikrofonu test et
❤️ STT.ai'yi seviyor musunuz?
Bedava çevirilerini kullandın.

600 dakika almak için ücretsiz kayıt olun veya binlerce daha fazlası için ayda 5 dolardan yükseltin.

Günde 10 dakika ücretsiz 600 dakika ücretsiz Kredi kartı yok. Şifrelenmiş
Ücretsiz kayıt olun →
İstemci taraflı şifreli depolama — Transkripleriniz tarayıcınızda şifrelenmiş, biz bile onları okuyamayız. Nasıl çalıştığını öğrenin →

Dünya çapında profesyoneller tarafından güvenilir

STT.ai Nasıl Çalışıyor

Doğru metin çevirisine giden üç adım

1. URL' yi Yükle, Kayıt Et veya Yapıştır

Herhangi bir ses veya video dosyasını (MP3, WAV, MP4 ve 20+ biçimde) çekin ve bırakın. Mikrofonunuzdan gerçek zamanlı olarak kaydedin. Ya da YouTube, Vimeo, TikTok ve 1.300+ platformdan bir bağlantı yapıştırın.

2. Yapay zeka, seçtiğiniz modelle yazıyor

Uygun Whisper modelini seçin: Enhanced (large-v3, en doğru), Turbo (hızlı, varsayılan), Medium veya Small. 99 seçenekten dile otomatik tespit. Konuşan diarization kim ne söyledi tanımla.

3. İhraç, Paylaş veya Entegre Et

TXT, SRT, VTT, DOCX, JSON veya PDF olarak indir. Bağlantı üzerinden paylaş. API'mizi kullanarak uygulamanıza transkripi entegre edin. Altyazılar, toplantı notları, podcastler ve daha fazlası için mükemmel.

100+
Desteklenen Diller
70+
Özgür Araçlar
1,300+
Desteklenen Platformlar
7
İhracat Biçimleri

Geliştirici Öncesi API

Uygulamanıza dakikalar içinde konuşma-metinde entegre edin. Gerçek zamanlı WebSocket akışı ile RESTful API.

REST + WebSocket — Dosya yükleme ve gerçek zamanlı akışı
Çok sayıda model — Whisper Turbo, Büyük V3, Orta ve Küçük
Konuşmacı diyaliz — Kimin ne dediğini otomatik olarak tespit et
Esnek çıkış — JSON, TXT, SRT, VTT sözcük zaman damgalarıyla
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Yazmaya hazır mısın?

İlk dosyayı ücretsiz yükleyin. Kredi kartı yok, üyelik yok. Bedava planı başlatmak için 600 dakika.

Yazdırmaya Başla

Sıkça Sorulan Sorular

Konuşma metin haline tarayıcınızda çalışır: URL'yi yapıştırın, bir dosya yükleyin veya mikrofonunuzdan kaydedin. STT.ai AI modelini seçer ve 5 dakika içinde metin çevirisini geri verir. TXT, SRT, VTT, DOCX, JSON veya PDF olarak ihraç edin.

Evet — her ziyaretçi STT.ai'de başlatmak için 600 ücretsiz dakika alır, Konuşma metin haline için diğer herhangi bir iş akışıyla aynı şekilde kullanılabilir. Ayda $5'dan başlayan ücretli planlar daha uzun dosyaları, özel metinleri ve öncelikli kuyruğu kilitlemektedir.

Konuşma metin haline STT.ai'in geri kalanıyla aynı AI modelleri üzerinde çalışır — en iyi modellerimiz temiz konuşmada %95-97 doğruluğa ulaşırlar (benchmarklarda %3-5 Sözcük Hata Oranı). İlk geçiş hedefinizin altındaysa modelleri uçuşa hazır olarak değiştirin.

Konuşma metin haline Whisper modellerinin herhangi birinde çalışabilir STT.ai host — STT.ai Enhanced (Whisper large-v3, en doğrusu, ücretli planlarda), Whisper Large V3, Whisper Turbo (hızlı), Whisper Medium ve Whisper Small.

Evet. Her bir transkrip SRT veya VTT olarak ihraç edilir. YouTube, Vimeo, TikTok, VLC ve diğer video oynatıcılarla çalışır. Yazma-altyazılı aracı onları videoya hardsubs olarak yerleştirir.

Evet. Sesli diary otomatik olarak her ses için bir etiket (Hafıza 1, Hafıza 2,...) oluşturur ve bunların ismini iç düzenleyicide değiştirebilirsiniz. Tüm model ve dillerde çalışır.

Çoğu Konuşma metin haline iş 5 dakikadan kısa sürede tamamlanır. 1 saatlik bir ses dosyası en hızlı modellerimizle genellikle 2-3 dakikada tamamlanır. Hız seçilen modele ve mevcut GPU yüküne bağlıdır.

Konuşma metin haline 20+ biçimi kabul eder — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI ve daha fazlası. Çıkış TXT, SRT, VTT, DOCX, JSON veya PDF.

Evet. Konuşma metin haline'a gönderilen ses dosyaları varsayılan olarak işleme alınır ve silinir. Pro planları istemci tarafı şifreleme ekler - STT.ai'in veritabanı hasar görse bile, metinleriniz anahtarınız olmadan okunmaz. Veriler açıkça katılma olmadan model eğitimi için asla kullanılmaz.

Evet. STT.ai Python ve Node.js SDK'ları ile bir REST API'si, Claude ve Cursor için bir MCP sunucusu sunuyor - hepsi Konuşma metin haline iş akışlarında kullanılabilir.

Evet. Her makale, kelimeleri düzelttiğiniz, konuşmacıları yeniden adlandırdığınız, zaman damgalarını ayarladığınız ve notlar eklediğiniz iç düzenleyicide açılır. Tüm değişiklikler otomatik olarak kaydedilir.

Her bir transkrip eşsiz bir paylaşılabilir URL alır. E-posta için DOCX veya PDF'ye ihraç edilir. Pro planları şifre ile korunan ve kalıcı bağlantılar ekler - müşteri çalışması için yararlı.

STT.ai, YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast ev sahipleri ve daha fazlası dahil olmak üzere 1.300+ platformu yönetir. URL transkripsiyonu sadece halka açık içerikle çalışır - DRM-koruyucu kaynaklar transkripsiyon yapılamaz.