Yapay Zeka Politikası ve Şeffaflık
Ne Yapay Zeka kullanıyoruz, nerede çalışıyor ve nasıl açıklanma gereksinimlerine uyduk (AB Yapay Zeka Yasası Madde 50, 2026-08-02'de geçerli).
TL;DR
- Tüm transkriptler yapay zeka tarafından üretiliyor ve her çıkışı makine tarafından okunabilir bir açıklama taşıyor.
- Tüm yapay zekalar kendi GPU'muzda çalışıyor. Sesinizi veya metninizi OpenAI, Anthropic, Google veya üçüncü taraf LLM API'sine göndermiyoruz.
- Biz transkripleriniz üzerinde temel modelleri eğitmiyoruz. Sadece seçme-kayıt-içir-değiştirme sizin açıkça yaptığınız düzeltmeleri kullanır.
- Sentetik ses klonları (TTS), dosya adı, meta veri ve sayfada açıkça AI-üretilen olarak etiketlenir.
Kullandığımız model
| Model | Bu için kullanılır | Lisans | Çalışıyor |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Çeviri (varsayılan) | MIT | GPU'muz |
| STT.ai Enhanced (custom fine-tune) | Transkripsiyon (ödemeli planlar) | MIT (base) / Proprietary (fine-tune weights) | GPU'muz |
| Vosk | Gerçek zamanlı sözcük akışı | Apache 2.0 | GPU'muz |
| SpeechBrain ECAPA-TDNN | Konuşmacı diyaliz | Apache 2.0 | GPU'muz |
| MadLAD-400 3B | Çeviri (450+ dil) | Apache 2.0 | GPU'muz |
| Qwen2.5-1.5B (llama.cpp) | Özet, analiz, içerik üretimi, RAG sohbet | Apache 2.0 | GPU'muz |
| F5-TTS | Ses klonlama / metin-sözlüğe | MIT | GPU'muz |
| all-MiniLM-L6-v2 | RAG arama için entegreler | Apache 2.0 | GPU'muz |
Herhangi bir özellik için OpenAI, Anthropic, Google Cloud veya üçüncü taraf LLM API'lerine başvurmuyoruz. Yukarıdaki her model, sahip olduğumuz ve işlettiğimiz donanım üzerinde çalışır. Kullandığımız tek dış AI hizmeti, UI stringlerini çevirmek için translateapi.ai (aynı zamanda Muddy Holdings) - bu asla yazılmış içeriğinize dokunmaz.
Yapay zekayı nasıl ortaya çıkarıyoruz
- HTML sayfalarını kopyala: include <meta name=\
- Metin ihracatları (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): her dosyanın başında 'AI-generated transcript' başlık satırı ekleyeceğiz.
- Sintetik ses / TTS çıkışı: WAV dosyaları meta verilerinde'sintetik ses' etiketi ve indirme sayfasında açık bir bildirim içerir. Sesli sorumluluk sınırlaması yol haritasındadır.
- API cevapları: transcribed içeriği içeren her JSON cevabına _ai_generated: true alanını dahil et.
Eğitim verileri
- Temel modelleri (Whisper, MadLAD, Qwen, vs.) ilgili yayıncılardan önceden eğitimli olarak geliyor. Onları gönderildiği gibi kullanıyoruz.
- Senin transkriptlerin temel modelleri eğitmek için kullanılmıyor.
- Eğer bir transkript bölümünü düzeltmişseniz (kalas simgesi) veya yanlış olarak işaretlemişseniz (bayrak simgesi), VE /privacy-settings/'de (\
- Farklı olarak, Ses Laboratuvarına düzeltmeler ve ses katkıda bulun (/privacy-settings/'de de varsayılan olarak kapalı) tuşu, düzelttiğiniz bölümlerin seslerini, düzeltilmiş metinle birlikte, CC-BY-SA-4.0 altındaki Ses Laboratuvarımız veri kümesine katkıda bulunmayı seçmenizi sağlar. Bu iki tuş bağımsızdır — birini, ikisini veya hiçbirini onaylaabilirsiniz.
- Yüklediğiniz ses 24 saat içinde cleanup_uploads cron aracılığıyla silinir — \'a katılmadığınız sürece
Kesinlik ve hatalar
AI transkripsyonu mükemmel değildir. Sözcük hata oranları konuşan aksanına, ses kalitesine, dile ve alan sözlüklerine göre değişir. Kritik kullanımlar için (hukuki, tıbbi, düzenleyici endüstriler) orijinal sesle karşılaştırınız. Model başına kamusal WER referanslarımız şu şekildedir: /models/.
Uygunluk soruları
AB Yapay Zeka Yasası, GDPR veya diğer uyumluluk soruları için: hello@stt.ai Ya da kullanın iletişim formu.
Son güncelleme: 2026-04-26.