AI бодлого ба ил тод байдал
Бидний ашиглаж буй хиймэл оюун ухаан, хаана ажилладаг, ил тод байдлын шаардлагыг хэрхэн хангадаг вэ (Европын Холбооны хиймэл оюун ухааны тухай хуулийн 50 дугаар зүйл, хүчин төгөлдөр 2026-08-02).
ТЭ; ДЭ
- Бүх бичлэгүүд нь AI-ээр үүсгэгдсэн. Бүх гарчиг нь машин уншдаг мэдээллийг агуулдаг.
- Бүх AI-г өөрийн график процессор дээр ажиллуулна. Бид таны дуу, текстийг OpenAI, Anthropic, Google, эсвэл бусад LLM API-д илгээхгүй.
- Бид таны бичлэг дээр суурь загваруудыг зааж өгөхгүй. Зөвхөн сонгосон тохиргоо нь таны хийсэн засваруудыг ашиглана.
- Синтетик дууны клонууд (TTS) нь файлын нэр, мета өгөгдөл, хуудас дээр AI-ээр үүсгэгдсэн гэж тодорхой заагагдсан байдаг.
Бидний ашигладаг загварууд
| Модель | Үүнд ашиглана | Лиценз | Ажиллуулж байна |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Бүртгэл | MIT | График процессор |
| STT.ai Enhanced (custom fine-tune) | Зохиогч | MIT (base) / Proprietary (fine-tune weights) | График процессор |
| Vosk | Тодорхой хугацааны үг дамжуулалт | Apache 2.0 | График процессор |
| SpeechBrain ECAPA-TDNN | Хөгжмийн зохиолч | Apache 2.0 | График процессор |
| MadLAD-400 3B | Зохиогч: | Apache 2.0 | График процессор |
| Qwen2.5-1.5B (llama.cpp) | Товчхондоо, анализ, агуулга үүсгэх, RAG яриа | Apache 2.0 | График процессор |
| F5-TTS | Хөгжмийн зохиолч | MIT | График процессор |
| all-MiniLM-L6-v2 | RAG хайлтын нийлэгүүдName | Apache 2.0 | График процессор |
Бид OpenAI, Anthropic, Google Cloud, эсвэл ямар ч гуравдагч этгээдийн LLM API-г ямар ч функцийг ашиглахдаа ашигладаггүй. Дээрх бүх загвар нь бидний эзэмшдэг болон ашигладаг тоног төхөөрөмж дээр ажилладаг. Бидний ашигладаг ганц гадаад AI үйлчилгээ бол UI strings-ийг орчуулах translateapi. ai (Muddy Holdings) юм. Энэ нь таны орчуулсан агуулгад хэзээ ч хүрдэггүй.
Бид хэрхэн хиймэл оюун ухааны үр удам үүсгэхийг илчилдэг вэ?
- HTML хуудас: < meta нэр=\
- Текст экспортлох (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): файлын дээд хэсэгт 'AI- generated transcript' хэмээх мөрийг оруулах
- Синтетик дуугаралт/ TTS гарчиг: WAV файлууд мета өгөгдөл дээр'synthetic-voice' тэмдгийг агуулж, татаж авах хуудсанд тодорхой мэдэгдэл агуулдаг.
- API хариултууд: _ai_generated: true талбарыг бүх JSON хариуд оруулах
Сургалтын мэдээ
- Үндсэн загварууд (Whisper, MadLAD, Qwen, гэх мэт) нь тухайн хэвлэгчээсээ урьдчилан бэлтгэгдсэн байдаг. Бид үүнийг шууд ашигладаг.
- Таны бичлэгүүд үндсэн загваруудыг сургахдаа ашиглагддаггүй.
- Хэрэв та бичлэгийн хэсгийг (харандааны дүрс) зассан бол эсвэл буруу гэж тэмдэглэсэн бол (хувцасны дүрс), мөн та / хувийн тохиргоо / - д тохируулсан бол (\
- Өөрөөр хэлбэл, "Хяналт засварыг дуугаар хамт дуут лабораторид оруулах" товчийг дарж (/privacy-settings/ дээр ч байдаг, урьдчилан тохируулсан тохиолдолд хаалттай байдаг) та CC-BY-SA-4.0-ийн дагуу зассан хэсгүүдийнхээ дууг CC-BY-SA-4.0-ийн дагуу зассан тексттэй хамт дуут лабораторийн мэдээллийн сан руу оруулах боломжтой. Энэ хоёр товч нь бие даасан бөгөөд та аль нэгийг нь, аль алиныг нь, эсвэл аль алиныг нь ч зөвшөөрөхгүй байж болно.
- Таны өргөж авсан дууны файлууд cleanup_ uploads cron- ийн тусламжтайгаар 24 цагийн дотор устгагдана. Хэрэв та \ -г сонгоогүй бол
Тодорхойлолт ба алдаа
AI транскрипц төгс биш. Үгний алдааны хувь нь яригчдын өнгө, дууны чанар, хэл, хэлний салбараас хамаарна. (Засгийн газар, эмнэлгийн, зохицуулалттай салбарууд) чухал хэрэглээний хувьд эх аудиотой харьцуулан шалгаарай. Манай нийтийн WER загвар бүрийн үзүүлэлтүүд нь /models/.
Холбоо барих асуултууд
Европын Хөдөлмөрийн тухай хууль, GDPR, эсвэл бусад зохицуулалтын асуултууд: hello@stt.ai эсвэл ашиглах холбоо барих.
Сүүлд шинэчлэгдсэн: 2026-04-26.