Şəffaflıq
Necə AI istifadə edirik, nə işləyəcək və necə açıqlanma tələblərinə uyğun gələcəyik (EU AI Act Article 50, effective 2026-08-02).
TL;DR
- Bütün transkriptlər AI-dən yaradılmışdır. Hər bir çıxış maşın oxuna bilən bir açıqlama daşıyır.
- Bütün AI öz GPU-da işləyir. Biz sizin audio və ya mətni OpenAI, Anthropic, Google, və ya hər hansı üçüncü tərəf LLM API-yə göndərmirik.
- Biz əsas modelləri sizin transkriptləriniz üzərində öyrətmirik. Yalnız opt-in fine-tune sizin açıqca etdiyiniz düzəlişləri istifadə edir.
- Sintetik səs klonları (TTS) açıqca AI-genered olaraq fayl adı, metadata və səhifədə etiketlənir.
İstifadə etdiyimiz modellər
| Model | Bu üçün istifadə olunur | Lisenziya | İşlədir |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Əvvəlcədən Qurğulu | MIT | GPU |
| STT.ai Enhanced (custom fine-tune) | Transkripsiya (ödənişli planlar) | MIT (base) / Proprietary (fine-tune weights) | GPU |
| Vosk | Həqiqət vaxtı söz axını | Apache 2.0 | GPU |
| SpeechBrain ECAPA-TDNN | Sənəd | Apache 2.0 | GPU |
| MadLAD-400 3B | Tərcümə | Apache 2.0 | GPU |
| Qwen2.5-1.5B (llama.cpp) | Təqdimatlar, analiz, məzmun istehsalı, RAG söhbəti | Apache 2.0 | GPU |
| F5-TTS | Səs klonlama / mətn-söhbətə çevirmə | MIT | GPU |
| all-MiniLM-L6-v2 | RAG axtarışı üçün daxili | Apache 2.0 | GPU |
Biz heç bir xüsusiyyət üçün OpenAI, Anthropic, Google Cloud, ya da hər hansı bir üçüncü tərəf LLM API çağırmırıq. Üstdəki hər bir model bizim sahib olduğumuz və idarə etdiyimiz avadanlıqda işləyir. İstifadə etdiyimiz tək xarici AI xidməti UI strings çevirmək üçün translateapi.ai (və Muddy Holdings) - bu heç vaxt sizin transcribed məzmununa toxunmur.
AI nəslini necə aşkar edirik
- HTML səhifələri: <meta name=\
- Mətn ixracatı (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): hər faylın üstündə 'AI-genered transcript' başlıq sətri daxil et.
- Sintetik səs / TTS çıxarışı: WAV faylları metadatada'synthetic-voice' təqviminə və yükləmə səhifəsində açıq xəbərdarlığa malikdir. Dinləyici məsuliyyətsizliyi yol xəritəsindədir.
- API cavabları: transkriptləşdirilmiş məzmun olan hər JSON cavabında _ai_generated: true sahəsi daxil et.
Təlimat
- Əsas modellər (Whisper, MadLAD, Qwen, və s.) öz müvafiq nəşriyyatlarından əvvəlcədən öyrədilmiş olaraq gəlir. Biz onları göndərildiyi kimi istifadə edirik.
- Sizin transkriptləriniz əsas modelləri öyrətmək üçün istifadə edilmir.
- Əgər transkriptin bir hissəsini düzəldirsinizsə (qaşıq simvolu) ya da onu səhv olaraq işarələyirsinizsə (bayraq simvolu), VƏ /privacy-settings/ (\
- Başqa bir seçim olaraq, səs laboratoriyasına düzəlişləri və səsi əlavə et düyməsi (/privacy-settings/-də də mövcuddur, əvvəlcədən işə salınıb) düzəltdiyiniz hissələrin səsini düzəltilmiş mətnlə birlikdə CC-BY-SA-4.0 altında səs laboratoriyası məlumat dəstəsinə əlavə etməyi seçir. Bu iki düymə müstəqildir - siz hər ikisini, ya da heç birini qəbul edə bilərsiniz.
- Yüklədiyiniz səs 24 saat ərzində cleanup_uploads cron vasitəsilə silinir - Əgər siz bunu seçməmisinizsə\
Düzgünlük və xətalar
AI transkripsiya mükəmməl deyil. Söz səhv dərəcələri danışan aksent, səs keyfiyyəti, dil və domen lüğəti ilə dəyişir. Çox vacib istifadə üçün (hüquqi, tibbi, tənzimlənən sənayelər) orijinal səslə müqayisədə yoxlayın. Bizim model üzrə ictimai WER benchmarklarımız /models/.
Bağlan
EU AI Act, GDPR, və ya digər uyğunluq sualları üçün: hello@stt.ai ya da istifadə et əlaqə forması.
Son Yeniləmə: 2026-04-26.