AI сиёсати ва шаффофлиги

Биз қандай ИИни ишлатамиз, у қаерда ишлайди ва биз қандай қилиб ошкор қилиш талабларига риоя қиламиз (ЕИ ИИ тўғрисидаги қонуннинг 50-моддаси, 2026-08-02 гача амал қилади).

TL;DR

  • Барча транскриптлар AI томонидан яратилган. Ҳар бир чиқим машина ўқий оладиган очиқликни олиб келади.
  • Барча ИИ ўз GPU'мизда ишлайди. Биз сизнинг аудио ёки матнингизни OpenAI, Anthropic, Google ёки бошқа LLM API'га юбормаймиз.
  • Биз сизнинг транскриптингиз бўйича базавий моделларни тайёрламаймиз. Фақат сиз очиқчасига қилган тузатишларни танлаб олиш учун яхшилаб созлашни қўллаймиз.
  • Синтетик овоз клонлари (TTS) файл номи, метамаълумотлар ва саҳифада AI-генерацияланган деб аниқ белгиланган.

Биз фойдаланадиган моделлар

МодельБунинг учун фойдаланилганЛицензияЮклаб олинди
Whisper large-v3-turbo (faster-whisper)Транскрипция (стандарт)MITБизнинг GPU
STT.ai Enhanced (custom fine-tune)Транскрипция (пулли)MIT (base) / Proprietary (fine-tune weights)Бизнинг GPU
VoskРеал вақтдаги сўзлар оқимиApache 2.0Бизнинг GPU
SpeechBrain ECAPA-TDNNСўзловчи диаризациясиApache 2.0Бизнинг GPU
MadLAD-400 3BТаржима (450+ тил)Apache 2.0Бизнинг GPU
Qwen2.5-1.5B (llama.cpp)Тақриз, таҳлил, мазмун яратиш, RAG суҳбатиApache 2.0Бизнинг GPU
F5-TTSТовушни клонлаш / матн-нутқMITБизнинг GPU
all-MiniLM-L6-v2RAG қидирув учун ёпишмаларApache 2.0Бизнинг GPU

Биз ҳеч қандай функция учун OpenAI, Anthropic, Google Cloud ёки бошқа LLM API'ни чақирмаймиз. Юқоридаги ҳар бир модел бизга тегишли ва биз бошқарадиган жиҳозларда ишлайди. Биз фойдаланадиган ягона ташқи AI хизмати UI string'ларини таржима қилиш учун translateapi.ai (шунингдек Muddy Holdings) - бу ҳеч қачон сизнинг транскрипция қилинган мазмунга тегмайди.

Биз қандай қилиб AI авлодни ошкор қиламиз

  • HTML саҳифаларини транскрипциялаш: <meta name=\
  • Матн экспорти (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Ҳар бир файлнинг бошида 'AI-генерация қилинган транскрипт' сарлавҳа сатрини киритиш.
  • Синтезланган овоз / TTS чиқиндиси: WAV файллари метамаълумотларда 'синтетик овоз' тегини ва юклаб олиш саҳифасида аниқ хабарни ўз ичига олади. Овозли жавобгарликдан воз кечиш йўл харитасида мавжуд.
  • API жавоблари: Ҳар бир JSON жавобида _ai_generated: true майдонни киритиш.

Машғулот маълумотлари

  • Базавий моделлар (Whisper, MadLAD, Qwen ва ҳоказо) ўз нашрчиларидан олдиндан тайёрланган ҳолда келади. Биз уларни жўнатилаётган ҳолларида фойдаланамиз.
  • Сизнинг транскриптларингиз база моделларини ўқитиш учун фойдаланилмайди.
  • Агар сиз транскрипт сегментини тўғриласангиз (қалам тасвири) ёки уни хато деб белгиласангиз (белги тасвири), ВА /privacy-settings/ (\
  • Айни пайтда, овоз лабораториясига тўғрилашлар ва аудиони қўшиш тугмаси (ҳам /privacy-settings/ да, ҳам олдиндан ўчирилган) сизнинг тўғрилаган сегментларингизнинг аудиосини, тўғриланган матн билан биргаликда, CC-BY-SA-4.0 остида овоз лабораторияси маълумотлар базасига қўшишни танлайди. Бу икки тугма мустақил — сиз бирини, иккаласини ёки ҳеч бирини танлайсиз.
  • Сиз юклаб олган аудио 24 соат ичида cleanup_uploads cron орқали ўчириб ташланади — агар сиз \'ни танламаган бўлсангиз

Дастлабки хатолар

AI транскрипцияси мукаммал эмас. сўз хато даражаси сўзловчи акценти, аудио сифати, тил ва домен луғати билан ўзгаради. муҳим фойдаланиш учун (ҳуқуқий, тиббий, тартибга солинган саноатлар) асл аудио билан текширинг. Бизнинг оммавий WER бенчмаркларимиз ҳар бир модел учун /models/.

Мувофиқлик саволлари

Европа Иттифоқининг AI Act, GDPR ёки бошқа мувофиқлик саволлари учун: hello@stt.ai ёки қуйидагини қўлланг алоқа шакли.

Сўнгги янгиланиш: 2026-04-26.