Правила комп' ютерного гравця і прозорість
Що ми використовуємо, де вона виконується, і як ми задовольняємо вимогам викриття (Акт ШІ 50, ефективна 2026-08-02).
TL; DR
- Всі протоколи створені комп' ютерним інтерфейсом. Кожен вивід містить можливість читання машин.
- Всі комп'ютери працюють на власній GPU. Ми НЕ надсилаємо ваш аудіо- чи текст OpenAI, Anthropic, Google або будь-який третій API LLM.
- Ми НЕ тренуємо базові моделі на ваших записах, а лише використовуються виправлення, які ви робите явно.
- Синтетичні клони голосів (TTS) чітко позначаються як AI- створення у назві файлів, метаданих і на сторінці.
Моделі, які ми використовуємо
| Модель | Використовується для | Ліцензія | Запускається |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Опис (типовий) | MIT | Наш спецназ |
| STT.ai Enhanced (custom fine-tune) | Переписування (заплатні плани) | MIT (base) / Proprietary (fine-tune weights) | Наш спецназ |
| Vosk | Поточування слів у режимі реального часу | Apache 2.0 | Наш спецназ |
| SpeechBrain ECAPA-TDNN | Діатризація мовця | Apache 2.0 | Наш спецназ |
| MadLAD-400 3B | Переклад (450+ мов) | Apache 2.0 | Наш спецназ |
| Qwen2.5-1.5B (llama.cpp) | Резюме, аналіз, створення вмісту, балачка RASG | Apache 2.0 | Наш спецназ |
| F5-TTS | Творення голосів / синтез мовлення з тексту | MIT | Наш спецназ |
| all-MiniLM-L6-v2 | Вбудовування для пошуку RASG | Apache 2.0 | Наш спецназ |
Ми не називаємо OpenAI, Anthroic, Google Hama або будь- яку з сторонніх програмних засобів. Кожна модель, наведена вище, працює на обладнанні і керує ним. Єдиною зовнішньою службою комп' ютерного зв' язку, яку ми використовуємо, є перекладапі.ai (також Mubidy Holdings) для перекладу рядків UI math } Таким чином ніколи не буде протягне на ваш записаний на tranced контент.
Як ми відкриваємо покоління комп'ютерних програм
- Сторінки HTML Transcript: include < meta name=\
- Експорт тексту (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): включити рядок заголовка " AI " нагорі кожного файла.
- Синтезований голос / TTS вивід: Файли WAV включають мітку " синтетичного звуку " у метадані і чітке повідомлення на сторінці звантаження. Виразний невизначений вимагач на карті.
- Відповіді API: включити _ai_ created: true поле у кожній відповіді JSON, у якій міститься конфігурований вміст.
Дані тренування
- Базові моделі (Whisper, MadLAD, Qwen тощо) надсилаються до їхніх відповідних вісників. Ми використовуємо їх як "оброблені"
- Твої документи НЕ використовуються для тренування моделей бази.
- Якщо ви виправили сегмент (піктограму олівця) або позначили неправильно (напис прапорця), І ви обрали цей варіант за адресою / crivacy- settings / (\
- Відокремлено, Contribute виправлення плюс звук з лабораторією голосу (також за адресою / criviic- settings /, також, типово вимкнено) надає вам змогу додавати звукові дані відрізків, які ви виправили, у парі з виправленим текстом, до нашого набору даних Lab для голосу під CC- VI- SA- 4. 0. Два перемикачі є незалежними } Ви можете дарувати або, і те, і інше.
- Аудіо, яке ви вивантажуєте, вилучається протягом 24 годин через cron } НЕЗАБОЖНО ви вибрали\
Точність і помилки
Реєстрація комп' ютера не є досконалою. Частота помилок слів різниться за допомогою акценту мовлення, якості звуку, мови та словника домену. Для критичного використання (легких, медичних, регульованих індустрій) перевірка на оригінальний звуковий звук. У нашому полі з' являтиметься загальний запис WER для кожної моделі. /models/.
Питання щодо відповідності
Для закону про ШІ, РСР або інших питань, пов'язаних з дотриманням вимог ЄС: hello@stt.ai або скористатися форма контакту.
Останнє оновлення: 2026-04-26.