سياسة الذكاء الاصطناعي والشفافية

ما هو الذكاء الاصطناعي الذي نستخدمه، وأين يعمل، وكيف نمتثل لمتطلبات الكشف (قانون الاتحاد الأوروبي للذكاء الاصطناعي، المادة 50، الساري المفعول 2026-08-02).

)الخطة(؛

  • كل النصوص متولدة بواسطة الذكاء الاصطناعي وكل منتج يحمل كشفاً مقروءاً آلياً
  • كل الذكاء الاصطناعي يعمل على وحدة المعالجة المركزية الخاصة بنا. ونحن لا نرسل صوتك أو نصك إلى OpenAI، Anthropic، Google، أو أي طرف ثالث LLM API.
  • نحن لا ندرب أي نموذج على نسختك. كل نموذج نقوم بتشغيله هو نموذج مفتوح المصدر. التصحيحات التي تقوم بها صراحة يتم جمعها فقط إذا اخترت المشاركة.
  • ويتم تصنيف نسخ الصوت الاصطناعية (TTS) بوضوح على أنها مولدة بواسطة الذكاء الاصطناعي في اسم الملف، والبيانات الوصفية، وعلى الصفحة.

النماذج التي نستخدمها

النموذجاستخدمت من أجلالترخيصتشغيل
Whisper large-v3-turbo (faster-whisper)النص المستنسخ (الافتراضي)MITوحدة المعالجة المركزية
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”النصوص (خطط مدفوعة)MITوحدة المعالجة المركزية
Voskتدفق الكلمات في الوقت الحقيقيApache 2.0وحدة المعالجة المركزية
SpeechBrain ECAPA-TDNN1 - تحليل المتحدثApache 2.0وحدة المعالجة المركزية
MadLAD-400 3Bالترجمة التحريرية (أكثر من 450 لغة)Apache 2.0وحدة المعالجة المركزية
Qwen2.5-1.5B (llama.cpp)الموجز، التحليل، توليد المحتوى، الدردشة مع فريق الخبراء المعني بالسياساتApache 2.0وحدة المعالجة المركزية
F5-TTSاستنساخ الصوت/تحويل النص إلى كلمةMITوحدة المعالجة المركزية
all-MiniLM-L6-v2ضم النتائج للبحث في RAGApache 2.0وحدة المعالجة المركزية

"STT.ai Enhanced" هو اسم منتجنا ل Whisper large-v3 الذي يعمل على وحدة المعالجة المركزية الخاصة بنا. فهو ليس نموذجا مخصصا، أو تحسينا، أو وزنا مملوكا - إنه أكبر وأكثر نقاط التحقق دقة في Whisper. وهو أكثر دقة من Whisper large-v3-turbo الافتراضي، وبطيء حوالي 1.5 مرة على عمل يومي، مقيس على معداتنا الخاصة.

نحن لا ندعو OpenAI، Anthropic، Google Cloud، أو أي طرف ثالث LLM API لأي خاصية. كل نموذج أعلاه يعمل على المعدات التي نملكها ونشغلها. الخدمة الذكاء الاصطناعي الخارجي الوحيد الذي نستخدمه هو translateapi.ai (كذلك Muddy Holdings) لترجمة سلسلة واجهة المستخدم - هذا لا يمس أبدا المحتوى المستنسخ.

كيف نكشف عن جيل الذكاء الاصطناعي

  • صفحات HTML: ضم <العنوان>
  • تصدير النصوص (TXT، SRT، VTT، JSON، CSV، DOCX، PDF): تتضمن سطر عنوان "النسخة المنشأة بواسطة الذكاء الاصطناعي" في أعلى كل ملف.
  • صوت اصطناعي/خرج TTS: تتضمن ملفات WAV علامة "صوت اصطناعي" في البيانات الوصفية وإشعار واضح على صفحة التنزيل. وهناك إخلاء مسؤولية سمعي على خريطة الطريق.
  • الردود على استعراضات سياسة الاستيراد: تضمن حقل _ai_generated: true في كل رد من ردود JSON التي تحتوي على محتوى مستنسخ.

بيانات التدريب

  • النماذج الأساسية (Whisper, MadLAD, Qwen, etc.) تأتي مدربة مسبقاً من الناشرين المعنيين، ونستخدمها كما هي.
  • نسختك لا تستخدم لتدريب نماذج الأساس
  • إذا قمت بتصحيح جزء من النص المستنسخ (أيقونة القلم) أو علامة على أنها غير صحيحة (أيقونة الراية)، وإذا كنت قد اخترت في / privacy-settings / (تبديل "تدريب النموذج"، افتراضيا غير متوفر)، (النص غير الصحيح → النص المصوب) زوج قد يتم جمعها لتدريب نموذج المستقبل النص-تصحيح. النص زوج فقط - لا الصوت المحيط - يستخدم من قبل هذا المسار. لا يوجد مثل هذا النموذج اليوم: الأزواج فقط مخزنة، وليس هناك شيء نحن حاليا نقدم تم تدريبهم على.
  • ومنفصلاً، فإن مفتاح التبديل المساهمة بالتصحيحات بالإضافة إلى الصوت إلى المختبر الصوتي (كذلك في /privacy-settings/، أيضاً معطل تلقائياً) يختارك للمساهمة بالصوت من الأجزاء التي تصححها، جنباً إلى جنب مع النص المصوب، إلى مجموعة بيانات المختبر الصوتي لدينا تحت CC-BY-SA-4.0. المفتاحان مستقلان - يمكنك منح أي منهما، أو كلاهما، أو لا شيء.
  • الصوت الذي ترفعه يتم حذفه خلال 24 ساعة من خلال cleanup_uploads cron — ما لم تكن قد اخترت \

الدقة والأخطاء

معدلات خطأ الكلمات تختلف باختلاف لهجة المتحدث، ونوعية الصوت، واللغة، والمفردات المتخصصة. بالنسبة للاستخدام الحرج (القانوني، الطبي، والصناعات المنظمة) التحقق من الصوت الأصلي. /models/.

مسائل الامتثال

بالنسبة لقانون الاتحاد الأوروبي للذكاء الاصطناعي، أو القواعد العامة لحماية البيانات، أو أسئلة الامتثال الأخرى: hello@stt.ai أو استخدام استمارة الاتصال.

آخر تحديث: 2026-08-05.