سیاست و شفافیت هوش مصنوعی

چه هوش مصنوعی استفاده می‌کنیم، کجا اجرا می‌شود و چگونه با الزامات افشاگری مطابقت داریم (قانون AI اتحادیه اروپا ماده ۵۰، اثربخش ۲۰۲۶-۰۸-۰۲).

..دکتر

  • همه رونوشت ها توسط هوش مصنوعی تولید میشه هر خروجی یک افشاگری قابل خواندن ماشینی داره
  • ما صدا یا متن شما را به OpenAI، Anthropic، Google یا هر API LLM سوم نفری نمی‌فرستیم.
  • ما مدل هاي پايه رو روي رونوشت هاي شما آموزش نميديم فقط يه دقيق سازي انتخابي از تصحيح هايي که شما به طور صريح انجام ميدين استفاده ميکنه
  • شبیه سازی‌های صدای مصنوعی (TTS) به روشنی در نام فایل، فراداده‌ها و در صفحه به عنوان تولید شده توسط هوش مصنوعی برچسب زده می‌شوند.

مدل هایی که استفاده می کنیم

مدلبرایمجوزاجرا می‌شود
Whisper large-v3-turbo (faster-whisper)رونوشت) پیش‌فرض (MITGPU ما
STT.ai Enhanced (custom fine-tune)رونوشت (پلان‌های پرداختی)MIT (base) / Proprietary (fine-tune weights)GPU ما
Voskجریان کلمه در زمان واقعیApache 2.0GPU ما
SpeechBrain ECAPA-TDNNصوتApache 2.0GPU ما
MadLAD-400 3Bترجمه (۴۵۰+ زبان)Apache 2.0GPU ما
Qwen2.5-1.5B (llama.cpp)خلاصه، تجزیه و تحلیل، تولید محتوا، گفتگوی RAGApache 2.0GPU ما
F5-TTSشبیه‌سازی صدا / متن به گفتارMITGPU ما
all-MiniLM-L6-v2جستجو در RAGNameApache 2.0GPU ما

ما OpenAI، Anthropic، Google Cloud، یا هر API LLM سومی را برای هیچ ویژگی‌ای فراخوانی نمی‌کنیم. هر مدل بالا بر روی سخت‌افزاری که ما مالک و اداره می‌کنیم اجرا می‌شود. تنها سرویس AI خارجی که ما استفاده می‌کنیم translateapi.ai (همچنین Muddy Holdings) برای ترجمه رشته‌های UI است - این هرگز به محتوای رونوشت شده شما دست نمی‌زند.

چگونه نسل هوش مصنوعی را آشکار کنیم

  • رونوشت صفحات HTML: شامل < meta name=\ >
  • صادرات متن) TXT ، SRT ، VTT ، JSON ، CSV ، DOCX ، PDF (: شامل یک خط سرآیند 'تصویر تولید شده توسط هوش مصنوعی' در بالای هر پرونده.
  • خروجی صدای ترکیبی / TTS: پرونده‌های WAV شامل برچسب «صدای مصنوعی» در فراداده‌ها و یک اطلاعیه واضح در صفحه بارگیری است. عدم مسئولیت شنیداری در نقشه راه است.
  • پاسخ‌های API: شامل یک _ai_generated: true field در هر پاسخ JSON که حاوی محتوای رونوشت شده است.

داده‌های آموزش

  • مدل‌های پایه (Whisper، MadLAD، Qwen، و غیره) از پیش آموزش داده شده از ناشران مربوطه می‌آیند. ما از آن‌ها به عنوان ارسال استفاده می‌کنیم.
  • از رونوشت هاي تو براي آموزش مدل هاي پايه استفاده نميشه
  • اگر یک بخش رونوشت را تصحیح کنید (تصویر مداد) یا آن را نادرست نشان دهید (تصویر پرچم)، و در / privacy- settings / (\
  • جداگانه، گزینه مشارکت در اصلاحات و صدا به آزمایشگاه صوتی (همچنین در /privacy-settings/، به صورت پیش‌فرض غیرفعال) شما را برای مشارکت در صدای بخش‌هایی که اصلاح کرده‌اید، همراه با متن اصلاح شده، به مجموعه داده‌های آزمایشگاه صوتی ما تحت CC-BY-SA-4.0 انتخاب می‌کند. این دو گزینه مستقل هستند — شما می‌توانید هر کدام را، هر دو را یا هیچ‌کدام را تأیید کنید.
  • صدایی که بارگذاری می‌کنید در عرض ۲۴ ساعت از طریق cron cleanup_uploads حذف می‌شود — مگر اینکه برای \ انتخاب کرده باشید

دقت و خطا

رونوشت هوش مصنوعی کامل نیست. نرخ خطای کلمات با لهجه سخنگو ، کیفیت صدا ، زبان و واژگان حوزه متفاوت است. برای استفاده حیاتی (قانونی ، پزشکی ، صنایع تنظیم شده) با صدای اصلی بررسی کنید. معیارهای عمومی WER ما برای هر مدل در /models/.

پرسش‌های مطابقت

برای قانون هوش مصنوعی اتحادیه اروپا، GDPR، یا دیگر سوالات مطابقت: hello@stt.ai يا از فرم تماس.

آخرین به‌روزرسانی: 2026-04-26.