Правила комп' ютерного гравця і прозорість

Що ми використовуємо, де вона виконується, і як ми задовольняємо вимогам викриття (Акт ШІ 50, ефективна 2026-08-02).

TL; DR

  • Всі протоколи створені комп' ютерним інтерфейсом. Кожен вивід містить можливість читання машин.
  • Всі комп'ютери працюють на власній GPU. Ми НЕ надсилаємо ваш аудіо- чи текст OpenAI, Anthropic, Google або будь-який третій API LLM.
  • Ми НЕ тренуємо базові моделі на ваших записах, а лише використовуються виправлення, які ви робите явно.
  • Синтетичні клони голосів (TTS) чітко позначаються як AI- створення у назві файлів, метаданих і на сторінці.

Моделі, які ми використовуємо

МодельВикористовується дляЛіцензіяЗапускається
Whisper large-v3-turbo (faster-whisper)Опис (типовий)MITНаш спецназ
STT.ai Enhanced (custom fine-tune)Переписування (заплатні плани)MIT (base) / Proprietary (fine-tune weights)Наш спецназ
VoskПоточування слів у режимі реального часуApache 2.0Наш спецназ
SpeechBrain ECAPA-TDNNДіатризація мовцяApache 2.0Наш спецназ
MadLAD-400 3BПереклад (450+ мов)Apache 2.0Наш спецназ
Qwen2.5-1.5B (llama.cpp)Резюме, аналіз, створення вмісту, балачка RASGApache 2.0Наш спецназ
F5-TTSТворення голосів / синтез мовлення з текстуMITНаш спецназ
all-MiniLM-L6-v2Вбудовування для пошуку RASGApache 2.0Наш спецназ

Ми не називаємо OpenAI, Anthroic, Google Hama або будь- яку з сторонніх програмних засобів. Кожна модель, наведена вище, працює на обладнанні і керує ним. Єдиною зовнішньою службою комп' ютерного зв' язку, яку ми використовуємо, є перекладапі.ai (також Mubidy Holdings) для перекладу рядків UI math } Таким чином ніколи не буде протягне на ваш записаний на tranced контент.

Як ми відкриваємо покоління комп'ютерних програм

  • Сторінки HTML Transcript: include < meta name=\
  • Експорт тексту (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): включити рядок заголовка " AI " нагорі кожного файла.
  • Синтезований голос / TTS вивід: Файли WAV включають мітку " синтетичного звуку " у метадані і чітке повідомлення на сторінці звантаження. Виразний невизначений вимагач на карті.
  • Відповіді API: включити _ai_ created: true поле у кожній відповіді JSON, у якій міститься конфігурований вміст.

Дані тренування

  • Базові моделі (Whisper, MadLAD, Qwen тощо) надсилаються до їхніх відповідних вісників. Ми використовуємо їх як "оброблені"
  • Твої документи НЕ використовуються для тренування моделей бази.
  • Якщо ви виправили сегмент (піктограму олівця) або позначили неправильно (напис прапорця), І ви обрали цей варіант за адресою / crivacy- settings / (\
  • Відокремлено, Contribute виправлення плюс звук з лабораторією голосу (також за адресою / criviic- settings /, також, типово вимкнено) надає вам змогу додавати звукові дані відрізків, які ви виправили, у парі з виправленим текстом, до нашого набору даних Lab для голосу під CC- VI- SA- 4. 0. Два перемикачі є незалежними } Ви можете дарувати або, і те, і інше.
  • Аудіо, яке ви вивантажуєте, вилучається протягом 24 годин через cron } НЕЗАБОЖНО ви вибрали\

Точність і помилки

Реєстрація комп' ютера не є досконалою. Частота помилок слів різниться за допомогою акценту мовлення, якості звуку, мови та словника домену. Для критичного використання (легких, медичних, регульованих індустрій) перевірка на оригінальний звуковий звук. У нашому полі з' являтиметься загальний запис WER для кожної моделі. /models/.

Питання щодо відповідності

Для закону про ШІ, РСР або інших питань, пов'язаних з дотриманням вимог ЄС: hello@stt.ai або скористатися форма контакту.

Останнє оновлення: 2026-04-26.