سیاست و شفافیت هوش مصنوعی
چه هوش مصنوعی استفاده میکنیم، کجا اجرا میشود و چگونه با الزامات افشاگری مطابقت داریم (قانون AI اتحادیه اروپا ماده ۵۰، اثربخش ۲۰۲۶-۰۸-۰۲).
..دکتر
- همه رونوشت ها توسط هوش مصنوعی تولید میشه هر خروجی یک افشاگری قابل خواندن ماشینی داره
- ما صدا یا متن شما را به OpenAI، Anthropic، Google یا هر API LLM سوم نفری نمیفرستیم.
- ما مدل هاي پايه رو روي رونوشت هاي شما آموزش نميديم فقط يه دقيق سازي انتخابي از تصحيح هايي که شما به طور صريح انجام ميدين استفاده ميکنه
- شبیه سازیهای صدای مصنوعی (TTS) به روشنی در نام فایل، فرادادهها و در صفحه به عنوان تولید شده توسط هوش مصنوعی برچسب زده میشوند.
مدل هایی که استفاده می کنیم
| مدل | برای | مجوز | اجرا میشود |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | رونوشت) پیشفرض ( | MIT | GPU ما |
| STT.ai Enhanced (custom fine-tune) | رونوشت (پلانهای پرداختی) | MIT (base) / Proprietary (fine-tune weights) | GPU ما |
| Vosk | جریان کلمه در زمان واقعی | Apache 2.0 | GPU ما |
| SpeechBrain ECAPA-TDNN | صوت | Apache 2.0 | GPU ما |
| MadLAD-400 3B | ترجمه (۴۵۰+ زبان) | Apache 2.0 | GPU ما |
| Qwen2.5-1.5B (llama.cpp) | خلاصه، تجزیه و تحلیل، تولید محتوا، گفتگوی RAG | Apache 2.0 | GPU ما |
| F5-TTS | شبیهسازی صدا / متن به گفتار | MIT | GPU ما |
| all-MiniLM-L6-v2 | جستجو در RAGName | Apache 2.0 | GPU ما |
ما OpenAI، Anthropic، Google Cloud، یا هر API LLM سومی را برای هیچ ویژگیای فراخوانی نمیکنیم. هر مدل بالا بر روی سختافزاری که ما مالک و اداره میکنیم اجرا میشود. تنها سرویس AI خارجی که ما استفاده میکنیم translateapi.ai (همچنین Muddy Holdings) برای ترجمه رشتههای UI است - این هرگز به محتوای رونوشت شده شما دست نمیزند.
چگونه نسل هوش مصنوعی را آشکار کنیم
- رونوشت صفحات HTML: شامل < meta name=\ >
- صادرات متن) TXT ، SRT ، VTT ، JSON ، CSV ، DOCX ، PDF (: شامل یک خط سرآیند 'تصویر تولید شده توسط هوش مصنوعی' در بالای هر پرونده.
- خروجی صدای ترکیبی / TTS: پروندههای WAV شامل برچسب «صدای مصنوعی» در فرادادهها و یک اطلاعیه واضح در صفحه بارگیری است. عدم مسئولیت شنیداری در نقشه راه است.
- پاسخهای API: شامل یک _ai_generated: true field در هر پاسخ JSON که حاوی محتوای رونوشت شده است.
دادههای آموزش
- مدلهای پایه (Whisper، MadLAD، Qwen، و غیره) از پیش آموزش داده شده از ناشران مربوطه میآیند. ما از آنها به عنوان ارسال استفاده میکنیم.
- از رونوشت هاي تو براي آموزش مدل هاي پايه استفاده نميشه
- اگر یک بخش رونوشت را تصحیح کنید (تصویر مداد) یا آن را نادرست نشان دهید (تصویر پرچم)، و در / privacy- settings / (\
- جداگانه، گزینه مشارکت در اصلاحات و صدا به آزمایشگاه صوتی (همچنین در /privacy-settings/، به صورت پیشفرض غیرفعال) شما را برای مشارکت در صدای بخشهایی که اصلاح کردهاید، همراه با متن اصلاح شده، به مجموعه دادههای آزمایشگاه صوتی ما تحت CC-BY-SA-4.0 انتخاب میکند. این دو گزینه مستقل هستند — شما میتوانید هر کدام را، هر دو را یا هیچکدام را تأیید کنید.
- صدایی که بارگذاری میکنید در عرض ۲۴ ساعت از طریق cron cleanup_uploads حذف میشود — مگر اینکه برای \ انتخاب کرده باشید
دقت و خطا
رونوشت هوش مصنوعی کامل نیست. نرخ خطای کلمات با لهجه سخنگو ، کیفیت صدا ، زبان و واژگان حوزه متفاوت است. برای استفاده حیاتی (قانونی ، پزشکی ، صنایع تنظیم شده) با صدای اصلی بررسی کنید. معیارهای عمومی WER ما برای هر مدل در /models/.
پرسشهای مطابقت
برای قانون هوش مصنوعی اتحادیه اروپا، GDPR، یا دیگر سوالات مطابقت: hello@stt.ai يا از فرم تماس.
آخرین بهروزرسانی: 2026-04-26.