سياسة الذكاء الاصطناعي والشفافية
ما هو الذكاء الاصطناعي الذي نستخدمه، وأين يعمل، وكيف نمتثل لمتطلبات الكشف (قانون الاتحاد الأوروبي للذكاء الاصطناعي، المادة 50، الساري المفعول 2026-08-02).
)الخطة(؛
- كل النصوص متولدة بواسطة الذكاء الاصطناعي وكل منتج يحمل كشفاً مقروءاً آلياً
- كل الذكاء الاصطناعي يعمل على وحدة المعالجة المركزية الخاصة بنا. ونحن لا نرسل صوتك أو نصك إلى OpenAI، Anthropic، Google، أو أي طرف ثالث LLM API.
- نحن لا ندرب نماذج قاعدة على نسختك فقط اختيار في ضبط دقيق يستخدم التصحيحات التي تقوم بها صراحة
- ويتم تصنيف نسخ الصوت الاصطناعية (TTS) بوضوح على أنها مولدة بواسطة الذكاء الاصطناعي في اسم الملف، والبيانات الوصفية، وعلى الصفحة.
النماذج التي نستخدمها
| النموذج | استخدمت من أجل | الترخيص | تشغيل |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | النص المستنسخ (الافتراضي) | MIT | وحدة المعالجة المركزية |
| STT.ai Enhanced (custom fine-tune) | النصوص (خطط مدفوعة) | MIT (base) / Proprietary (fine-tune weights) | وحدة المعالجة المركزية |
| Vosk | تدفق الكلمات في الوقت الحقيقي | Apache 2.0 | وحدة المعالجة المركزية |
| SpeechBrain ECAPA-TDNN | 1 - تحليل المتحدث | Apache 2.0 | وحدة المعالجة المركزية |
| MadLAD-400 3B | الترجمة التحريرية (أكثر من 450 لغة) | Apache 2.0 | وحدة المعالجة المركزية |
| Qwen2.5-1.5B (llama.cpp) | الموجز، التحليل، توليد المحتوى، الدردشة مع فريق الخبراء المعني بالسياسات | Apache 2.0 | وحدة المعالجة المركزية |
| F5-TTS | استنساخ الصوت/تحويل النص إلى كلمة | MIT | وحدة المعالجة المركزية |
| all-MiniLM-L6-v2 | ضم النتائج للبحث في RAG | Apache 2.0 | وحدة المعالجة المركزية |
نحن لا ندعو OpenAI، Anthropic، Google Cloud، أو أي طرف ثالث LLM API لأي خاصية. كل نموذج أعلاه يعمل على المعدات التي نملكها ونشغلها. الخدمة الذكاء الاصطناعي الخارجي الوحيد الذي نستخدمه هو translateapi.ai (كذلك Muddy Holdings) لترجمة سلسلة واجهة المستخدم - هذا لا يمس أبدا المحتوى المستنسخ.
كيف نكشف عن جيل الذكاء الاصطناعي
- صفحات HTML: ضم <العنوان>
- تصدير النصوص (TXT، SRT، VTT، JSON، CSV، DOCX، PDF): تتضمن سطر عنوان "النسخة المنشأة بواسطة الذكاء الاصطناعي" في أعلى كل ملف.
- صوت اصطناعي/خرج TTS: تتضمن ملفات WAV علامة "صوت اصطناعي" في البيانات الوصفية وإشعار واضح على صفحة التنزيل. وهناك إخلاء مسؤولية سمعي على خريطة الطريق.
- الردود على استعراضات سياسة الاستيراد: تضمن حقل _ai_generated: true في كل رد من ردود JSON التي تحتوي على محتوى مستنسخ.
بيانات التدريب
- النماذج الأساسية (Whisper, MadLAD, Qwen, etc.) تأتي مدربة مسبقاً من الناشرين المعنيين، ونستخدمها كما هي.
- نسختك لا تستخدم لتدريب نماذج الأساس
- إذا قمت بتصحيح جزء من النص (رمز القلم) أو علامة على أنه غير صحيح (رمز الراية)، وأنك اخترت في / privacy-settings / (\
- ومنفصلاً، فإن مفتاح التبديل المساهمة بالتصحيحات بالإضافة إلى الصوت إلى المختبر الصوتي (كذلك في /privacy-settings/، أيضاً معطل تلقائياً) يختارك للمساهمة بالصوت من الأجزاء التي تصححها، جنباً إلى جنب مع النص المصوب، إلى مجموعة بيانات المختبر الصوتي لدينا تحت CC-BY-SA-4.0. المفتاحان مستقلان - يمكنك منح أي منهما، أو كلاهما، أو لا شيء.
- الصوت الذي ترفعه يتم حذفه خلال 24 ساعة من خلال cleanup_uploads cron — ما لم تكن قد اخترت \
الدقة والأخطاء
معدلات خطأ الكلمات تختلف باختلاف لهجة المتحدث، ونوعية الصوت، واللغة، والمفردات المتخصصة. بالنسبة للاستخدام الحرج (القانوني، الطبي، والصناعات المنظمة) التحقق من الصوت الأصلي. /models/.
مسائل الامتثال
بالنسبة لقانون الاتحاد الأوروبي للذكاء الاصطناعي، أو القواعد العامة لحماية البيانات، أو أسئلة الامتثال الأخرى: hello@stt.ai أو استخدام استمارة الاتصال.
آخر تحديث: 2026-04-26.