Şəffaflıq

Necə AI istifadə edirik, nə işləyəcək və necə açıqlanma tələblərinə uyğun gələcəyik (EU AI Act Article 50, effective 2026-08-02).

TL;DR

  • Bütün transkriptlər AI-dən yaradılmışdır. Hər bir çıxış maşın oxuna bilən bir açıqlama daşıyır.
  • Bütün AI öz GPU-da işləyir. Biz sizin audio və ya mətni OpenAI, Anthropic, Google, və ya hər hansı üçüncü tərəf LLM API-yə göndərmirik.
  • Biz əsas modelləri sizin transkriptləriniz üzərində öyrətmirik. Yalnız opt-in fine-tune sizin açıqca etdiyiniz düzəlişləri istifadə edir.
  • Sintetik səs klonları (TTS) açıqca AI-genered olaraq fayl adı, metadata və səhifədə etiketlənir.

İstifadə etdiyimiz modellər

ModelBu üçün istifadə olunurLisenziyaİşlədir
Whisper large-v3-turbo (faster-whisper)Əvvəlcədən QurğuluMITGPU
STT.ai Enhanced (custom fine-tune)Transkripsiya (ödənişli planlar)MIT (base) / Proprietary (fine-tune weights)GPU
VoskHəqiqət vaxtı söz axınıApache 2.0GPU
SpeechBrain ECAPA-TDNNSənədApache 2.0GPU
MadLAD-400 3BTərcüməApache 2.0GPU
Qwen2.5-1.5B (llama.cpp)Təqdimatlar, analiz, məzmun istehsalı, RAG söhbətiApache 2.0GPU
F5-TTSSəs klonlama / mətn-söhbətə çevirməMITGPU
all-MiniLM-L6-v2RAG axtarışı üçün daxiliApache 2.0GPU

Biz heç bir xüsusiyyət üçün OpenAI, Anthropic, Google Cloud, ya da hər hansı bir üçüncü tərəf LLM API çağırmırıq. Üstdəki hər bir model bizim sahib olduğumuz və idarə etdiyimiz avadanlıqda işləyir. İstifadə etdiyimiz tək xarici AI xidməti UI strings çevirmək üçün translateapi.ai (və Muddy Holdings) - bu heç vaxt sizin transcribed məzmununa toxunmur.

AI nəslini necə aşkar edirik

  • HTML səhifələri: <meta name=\
  • Mətn ixracatı (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): hər faylın üstündə 'AI-genered transcript' başlıq sətri daxil et.
  • Sintetik səs / TTS çıxarışı: WAV faylları metadatada'synthetic-voice' təqviminə və yükləmə səhifəsində açıq xəbərdarlığa malikdir. Dinləyici məsuliyyətsizliyi yol xəritəsindədir.
  • API cavabları: transkriptləşdirilmiş məzmun olan hər JSON cavabında _ai_generated: true sahəsi daxil et.

Təlimat

  • Əsas modellər (Whisper, MadLAD, Qwen, və s.) öz müvafiq nəşriyyatlarından əvvəlcədən öyrədilmiş olaraq gəlir. Biz onları göndərildiyi kimi istifadə edirik.
  • Sizin transkriptləriniz əsas modelləri öyrətmək üçün istifadə edilmir.
  • Əgər transkriptin bir hissəsini düzəldirsinizsə (qaşıq simvolu) ya da onu səhv olaraq işarələyirsinizsə (bayraq simvolu), VƏ /privacy-settings/ (\
  • Başqa bir seçim olaraq, səs laboratoriyasına düzəlişləri və səsi əlavə et düyməsi (/privacy-settings/-də də mövcuddur, əvvəlcədən işə salınıb) düzəltdiyiniz hissələrin səsini düzəltilmiş mətnlə birlikdə CC-BY-SA-4.0 altında səs laboratoriyası məlumat dəstəsinə əlavə etməyi seçir. Bu iki düymə müstəqildir - siz hər ikisini, ya da heç birini qəbul edə bilərsiniz.
  • Yüklədiyiniz səs 24 saat ərzində cleanup_uploads cron vasitəsilə silinir - Əgər siz bunu seçməmisinizsə\

Düzgünlük və xətalar

AI transkripsiya mükəmməl deyil. Söz səhv dərəcələri danışan aksent, səs keyfiyyəti, dil və domen lüğəti ilə dəyişir. Çox vacib istifadə üçün (hüquqi, tibbi, tənzimlənən sənayelər) orijinal səslə müqayisədə yoxlayın. Bizim model üzrə ictimai WER benchmarklarımız /models/.

Bağlan

EU AI Act, GDPR, və ya digər uyğunluq sualları üçün: hello@stt.ai ya da istifadə et əlaqə forması.

Son Yeniləmə: 2026-04-26.