سیاست و شفافیت هوش مصنوعی

چه هوش مصنوعی استفاده می‌کنیم، کجا اجرا می‌شود و چگونه با الزامات افشاگری مطابقت داریم (قانون AI اتحادیه اروپا ماده ۵۰، اثربخش ۲۰۲۶-۰۸-۰۲).

..دکتر

  • همه رونوشت ها توسط هوش مصنوعی تولید میشه هر خروجی یک افشاگری قابل خواندن ماشینی داره
  • ما صدا یا متن شما را به OpenAI، Anthropic، Google یا هر API LLM سوم نفری نمی‌فرستیم.
  • ما هیچ مدلی را بر روی رونوشت شما آموزش نمی‌دهیم. هر مدلی که اجرا می‌کنیم یک مدل منبع باز است. تصحیح‌هایی که به‌طور صریح انجام می‌دهید فقط اگر انتخاب کنید جمع‌آوری می‌شوند.
  • شبیه سازی‌های صدای مصنوعی (TTS) به روشنی در نام فایل، فراداده‌ها و در صفحه به عنوان تولید شده توسط هوش مصنوعی برچسب زده می‌شوند.

مدل هایی که استفاده می کنیم

مدلبرایمجوزاجرا می‌شود
Whisper large-v3-turbo (faster-whisper)رونوشت) پیش‌فرض (MITGPU ما
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”رونوشت (پلان‌های پرداختی)MITGPU ما
Voskجریان کلمه در زمان واقعیApache 2.0GPU ما
SpeechBrain ECAPA-TDNNصوتApache 2.0GPU ما
MadLAD-400 3Bترجمه (۴۵۰+ زبان)Apache 2.0GPU ما
Qwen2.5-1.5B (llama.cpp)خلاصه، تجزیه و تحلیل، تولید محتوا، گفتگوی RAGApache 2.0GPU ما
F5-TTSشبیه‌سازی صدا / متن به گفتارMITGPU ما
all-MiniLM-L6-v2جستجو در RAGNameApache 2.0GPU ما

“STT.ai Enhanced” is our product name for Whisper large-v3 running on our own GPU. It is not a custom model, a fine-tune, or proprietary weights — it is the largest and most accurate Whisper checkpoint. It is more accurate than the default Whisper large-v3-turbo, and about 1.5x slower on a diarized job, measured on our own hardware.

ما OpenAI، Anthropic، Google Cloud، یا هر API LLM سومی را برای هیچ ویژگی‌ای فراخوانی نمی‌کنیم. هر مدل بالا بر روی سخت‌افزاری که ما مالک و اداره می‌کنیم اجرا می‌شود. تنها سرویس AI خارجی که ما استفاده می‌کنیم translateapi.ai (همچنین Muddy Holdings) برای ترجمه رشته‌های UI است - این هرگز به محتوای رونوشت شده شما دست نمی‌زند.

چگونه نسل هوش مصنوعی را آشکار کنیم

  • رونوشت صفحات HTML: شامل < meta name=\ >
  • صادرات متن) TXT ، SRT ، VTT ، JSON ، CSV ، DOCX ، PDF (: شامل یک خط سرآیند 'تصویر تولید شده توسط هوش مصنوعی' در بالای هر پرونده.
  • خروجی صدای ترکیبی / TTS: پرونده‌های WAV شامل برچسب «صدای مصنوعی» در فراداده‌ها و یک اطلاعیه واضح در صفحه بارگیری است. عدم مسئولیت شنیداری در نقشه راه است.
  • پاسخ‌های API: شامل یک _ai_generated: true field در هر پاسخ JSON که حاوی محتوای رونوشت شده است.

داده‌های آموزش

  • مدل‌های پایه (Whisper، MadLAD، Qwen، و غیره) از پیش آموزش داده شده از ناشران مربوطه می‌آیند. ما از آن‌ها به عنوان ارسال استفاده می‌کنیم.
  • از رونوشت هاي تو براي آموزش مدل هاي پايه استفاده نميشه
  • اگر یک قطعه رونوشت را تصحیح کنید (تصویر مداد) یا آن را اشتباه نشان دهید (تصویر پرچم)، و در /privacy-settings/ (تغییر حالت آموزش مدل ، پیش‌فرض غیرفعال) انتخاب کرده‌اید ، جفت (متن نادرست → متن تصحیح شده) ممکن است برای آموزش یک مدل تصحیح متن آینده جمع‌آوری شود. تنها جفت متن — هرگز صدای اطراف — توسط این مسیر استفاده می‌شود. امروز چنین مدلی وجود ندارد: جفت‌ها فقط ذخیره می‌شوند ، و چیزی که در حال حاضر ارائه می‌کنیم ، بر روی آنها آموزش داده نشده است.
  • جداگانه، گزینه مشارکت در اصلاحات و صدا به آزمایشگاه صوتی (همچنین در /privacy-settings/، به صورت پیش‌فرض غیرفعال) شما را برای مشارکت در صدای بخش‌هایی که اصلاح کرده‌اید، همراه با متن اصلاح شده، به مجموعه داده‌های آزمایشگاه صوتی ما تحت CC-BY-SA-4.0 انتخاب می‌کند. این دو گزینه مستقل هستند — شما می‌توانید هر کدام را، هر دو را یا هیچ‌کدام را تأیید کنید.
  • صدایی که بارگذاری می‌کنید در عرض ۲۴ ساعت از طریق cron cleanup_uploads حذف می‌شود — مگر اینکه برای \ انتخاب کرده باشید

دقت و خطا

رونوشت هوش مصنوعی کامل نیست. نرخ خطای کلمات با لهجه سخنگو ، کیفیت صدا ، زبان و واژگان حوزه متفاوت است. برای استفاده حیاتی (قانونی ، پزشکی ، صنایع تنظیم شده) با صدای اصلی بررسی کنید. معیارهای عمومی WER ما برای هر مدل در /models/.

پرسش‌های مطابقت

برای قانون هوش مصنوعی اتحادیه اروپا، GDPR، یا دیگر سوالات مطابقت: hello@stt.ai يا از فرم تماس.

آخرین به‌روزرسانی: 2026-08-05.