سیاست و شفافیت هوش مصنوعی
چه هوش مصنوعی استفاده میکنیم، کجا اجرا میشود و چگونه با الزامات افشاگری مطابقت داریم (قانون AI اتحادیه اروپا ماده ۵۰، اثربخش ۲۰۲۶-۰۸-۰۲).
..دکتر
- همه رونوشت ها توسط هوش مصنوعی تولید میشه هر خروجی یک افشاگری قابل خواندن ماشینی داره
- ما صدا یا متن شما را به OpenAI، Anthropic، Google یا هر API LLM سوم نفری نمیفرستیم.
- ما هیچ مدلی را بر روی رونوشت شما آموزش نمیدهیم. هر مدلی که اجرا میکنیم یک مدل منبع باز است. تصحیحهایی که بهطور صریح انجام میدهید فقط اگر انتخاب کنید جمعآوری میشوند.
- شبیه سازیهای صدای مصنوعی (TTS) به روشنی در نام فایل، فرادادهها و در صفحه به عنوان تولید شده توسط هوش مصنوعی برچسب زده میشوند.
مدل هایی که استفاده می کنیم
| مدل | برای | مجوز | اجرا میشود |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | رونوشت) پیشفرض ( | MIT | GPU ما |
| Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced” | رونوشت (پلانهای پرداختی) | MIT | GPU ما |
| Vosk | جریان کلمه در زمان واقعی | Apache 2.0 | GPU ما |
| SpeechBrain ECAPA-TDNN | صوت | Apache 2.0 | GPU ما |
| MadLAD-400 3B | ترجمه (۴۵۰+ زبان) | Apache 2.0 | GPU ما |
| Qwen2.5-1.5B (llama.cpp) | خلاصه، تجزیه و تحلیل، تولید محتوا، گفتگوی RAG | Apache 2.0 | GPU ما |
| F5-TTS | شبیهسازی صدا / متن به گفتار | MIT | GPU ما |
| all-MiniLM-L6-v2 | جستجو در RAGName | Apache 2.0 | GPU ما |
“STT.ai Enhanced” is our product name for Whisper large-v3 running on our own GPU. It is not a custom model, a fine-tune, or proprietary weights — it is the largest and most accurate Whisper checkpoint. It is more accurate than the default Whisper large-v3-turbo, and about 1.5x slower on a diarized job, measured on our own hardware.
ما OpenAI، Anthropic، Google Cloud، یا هر API LLM سومی را برای هیچ ویژگیای فراخوانی نمیکنیم. هر مدل بالا بر روی سختافزاری که ما مالک و اداره میکنیم اجرا میشود. تنها سرویس AI خارجی که ما استفاده میکنیم translateapi.ai (همچنین Muddy Holdings) برای ترجمه رشتههای UI است - این هرگز به محتوای رونوشت شده شما دست نمیزند.
چگونه نسل هوش مصنوعی را آشکار کنیم
- رونوشت صفحات HTML: شامل < meta name=\ >
- صادرات متن) TXT ، SRT ، VTT ، JSON ، CSV ، DOCX ، PDF (: شامل یک خط سرآیند 'تصویر تولید شده توسط هوش مصنوعی' در بالای هر پرونده.
- خروجی صدای ترکیبی / TTS: پروندههای WAV شامل برچسب «صدای مصنوعی» در فرادادهها و یک اطلاعیه واضح در صفحه بارگیری است. عدم مسئولیت شنیداری در نقشه راه است.
- پاسخهای API: شامل یک _ai_generated: true field در هر پاسخ JSON که حاوی محتوای رونوشت شده است.
دادههای آموزش
- مدلهای پایه (Whisper، MadLAD، Qwen، و غیره) از پیش آموزش داده شده از ناشران مربوطه میآیند. ما از آنها به عنوان ارسال استفاده میکنیم.
- از رونوشت هاي تو براي آموزش مدل هاي پايه استفاده نميشه
- اگر یک قطعه رونوشت را تصحیح کنید (تصویر مداد) یا آن را اشتباه نشان دهید (تصویر پرچم)، و در /privacy-settings/ (تغییر حالت آموزش مدل ، پیشفرض غیرفعال) انتخاب کردهاید ، جفت (متن نادرست → متن تصحیح شده) ممکن است برای آموزش یک مدل تصحیح متن آینده جمعآوری شود. تنها جفت متن — هرگز صدای اطراف — توسط این مسیر استفاده میشود. امروز چنین مدلی وجود ندارد: جفتها فقط ذخیره میشوند ، و چیزی که در حال حاضر ارائه میکنیم ، بر روی آنها آموزش داده نشده است.
- جداگانه، گزینه مشارکت در اصلاحات و صدا به آزمایشگاه صوتی (همچنین در /privacy-settings/، به صورت پیشفرض غیرفعال) شما را برای مشارکت در صدای بخشهایی که اصلاح کردهاید، همراه با متن اصلاح شده، به مجموعه دادههای آزمایشگاه صوتی ما تحت CC-BY-SA-4.0 انتخاب میکند. این دو گزینه مستقل هستند — شما میتوانید هر کدام را، هر دو را یا هیچکدام را تأیید کنید.
- صدایی که بارگذاری میکنید در عرض ۲۴ ساعت از طریق cron cleanup_uploads حذف میشود — مگر اینکه برای \ انتخاب کرده باشید
دقت و خطا
رونوشت هوش مصنوعی کامل نیست. نرخ خطای کلمات با لهجه سخنگو ، کیفیت صدا ، زبان و واژگان حوزه متفاوت است. برای استفاده حیاتی (قانونی ، پزشکی ، صنایع تنظیم شده) با صدای اصلی بررسی کنید. معیارهای عمومی WER ما برای هر مدل در /models/.
پرسشهای مطابقت
برای قانون هوش مصنوعی اتحادیه اروپا، GDPR، یا دیگر سوالات مطابقت: hello@stt.ai يا از فرم تماس.
آخرین بهروزرسانی: 2026-08-05.