AI сиёсати ва шаффофлиги
Биз қандай ИИни ишлатамиз, у қаерда ишлайди ва биз қандай қилиб ошкор қилиш талабларига риоя қиламиз (ЕИ ИИ тўғрисидаги қонуннинг 50-моддаси, 2026-08-02 гача амал қилади).
TL;DR
- Барча транскриптлар AI томонидан яратилган. Ҳар бир чиқим машина ўқий оладиган очиқликни олиб келади.
- Барча ИИ ўз GPU'мизда ишлайди. Биз сизнинг аудио ёки матнингизни OpenAI, Anthropic, Google ёки бошқа LLM API'га юбормаймиз.
- Биз сизнинг транскриптингиз бўйича базавий моделларни тайёрламаймиз. Фақат сиз очиқчасига қилган тузатишларни танлаб олиш учун яхшилаб созлашни қўллаймиз.
- Синтетик овоз клонлари (TTS) файл номи, метамаълумотлар ва саҳифада AI-генерацияланган деб аниқ белгиланган.
Биз фойдаланадиган моделлар
| Модель | Бунинг учун фойдаланилган | Лицензия | Юклаб олинди |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Транскрипция (стандарт) | MIT | Бизнинг GPU |
| STT.ai Enhanced (custom fine-tune) | Транскрипция (пулли) | MIT (base) / Proprietary (fine-tune weights) | Бизнинг GPU |
| Vosk | Реал вақтдаги сўзлар оқими | Apache 2.0 | Бизнинг GPU |
| SpeechBrain ECAPA-TDNN | Сўзловчи диаризацияси | Apache 2.0 | Бизнинг GPU |
| MadLAD-400 3B | Таржима (450+ тил) | Apache 2.0 | Бизнинг GPU |
| Qwen2.5-1.5B (llama.cpp) | Тақриз, таҳлил, мазмун яратиш, RAG суҳбати | Apache 2.0 | Бизнинг GPU |
| F5-TTS | Товушни клонлаш / матн-нутқ | MIT | Бизнинг GPU |
| all-MiniLM-L6-v2 | RAG қидирув учун ёпишмалар | Apache 2.0 | Бизнинг GPU |
Биз ҳеч қандай функция учун OpenAI, Anthropic, Google Cloud ёки бошқа LLM API'ни чақирмаймиз. Юқоридаги ҳар бир модел бизга тегишли ва биз бошқарадиган жиҳозларда ишлайди. Биз фойдаланадиган ягона ташқи AI хизмати UI string'ларини таржима қилиш учун translateapi.ai (шунингдек Muddy Holdings) - бу ҳеч қачон сизнинг транскрипция қилинган мазмунга тегмайди.
Биз қандай қилиб AI авлодни ошкор қиламиз
- HTML саҳифаларини транскрипциялаш: <meta name=\
- Матн экспорти (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Ҳар бир файлнинг бошида 'AI-генерация қилинган транскрипт' сарлавҳа сатрини киритиш.
- Синтезланган овоз / TTS чиқиндиси: WAV файллари метамаълумотларда 'синтетик овоз' тегини ва юклаб олиш саҳифасида аниқ хабарни ўз ичига олади. Овозли жавобгарликдан воз кечиш йўл харитасида мавжуд.
- API жавоблари: Ҳар бир JSON жавобида _ai_generated: true майдонни киритиш.
Машғулот маълумотлари
- Базавий моделлар (Whisper, MadLAD, Qwen ва ҳоказо) ўз нашрчиларидан олдиндан тайёрланган ҳолда келади. Биз уларни жўнатилаётган ҳолларида фойдаланамиз.
- Сизнинг транскриптларингиз база моделларини ўқитиш учун фойдаланилмайди.
- Агар сиз транскрипт сегментини тўғриласангиз (қалам тасвири) ёки уни хато деб белгиласангиз (белги тасвири), ВА /privacy-settings/ (\
- Айни пайтда, овоз лабораториясига тўғрилашлар ва аудиони қўшиш тугмаси (ҳам /privacy-settings/ да, ҳам олдиндан ўчирилган) сизнинг тўғрилаган сегментларингизнинг аудиосини, тўғриланган матн билан биргаликда, CC-BY-SA-4.0 остида овоз лабораторияси маълумотлар базасига қўшишни танлайди. Бу икки тугма мустақил — сиз бирини, иккаласини ёки ҳеч бирини танлайсиз.
- Сиз юклаб олган аудио 24 соат ичида cleanup_uploads cron орқали ўчириб ташланади — агар сиз \'ни танламаган бўлсангиз
Дастлабки хатолар
AI транскрипцияси мукаммал эмас. сўз хато даражаси сўзловчи акценти, аудио сифати, тил ва домен луғати билан ўзгаради. муҳим фойдаланиш учун (ҳуқуқий, тиббий, тартибга солинган саноатлар) асл аудио билан текширинг. Бизнинг оммавий WER бенчмаркларимиз ҳар бир модел учун /models/.
Мувофиқлик саволлари
Европа Иттифоқининг AI Act, GDPR ёки бошқа мувофиқлик саволлари учун: hello@stt.ai ёки қуйидагини қўлланг алоқа шакли.
Сўнгги янгиланиш: 2026-04-26.