Прагляд
У 1999 годзе ўступіў у сілу закон аб абароне правоў і свабод чалавека, які ўвёў у дзеянне артыкул 20 (208-209).
Дрэва
- Усе транскрыпцыі створаны AI. Кожны вывад нясе машыначытабельную інфармацыю.
- Усе AI працуе на нашым уласным GPU. Мы НЕ адпраўляем ваш аўдыё або тэкст у OpenAI, Anthropic, Google, або любы трэці LLM API.
- Мы НЕ трэніруем базу мадэляў на вашых транскрыптах. Толькі ўключэнне дакладнай наладкі выкарыстоўвае карэкцыі, якія вы выразна зрабілі.
- Сінтэтычныя галасавыя клоны (TTS) выразна пазначаны як AI-генераваныя ў імя файла, метададзеных і на старонцы.
Модулі, якія мы выкарыстоўваем
| Модуль | Выкарыстоўваецца для | Ліцэнзія | Запушчана |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Праграма | MIT | Нашы GPU |
| STT.ai Enhanced (custom fine-tune) | Транскрипция (платная) | MIT (base) / Proprietary (fine-tune weights) | Нашы GPU |
| Vosk | Прагляд словаў у рэальным часе | Apache 2.0 | Нашы GPU |
| SpeechBrain ECAPA-TDNN | Дыялогавае акно | Apache 2.0 | Нашы GPU |
| MadLAD-400 3B | Пераклад (450+ моў) Name | Apache 2.0 | Нашы GPU |
| Qwen2.5-1.5B (llama.cpp) | Падрабязнасьці, аналіз, стварэньне зьместу, RAG- чат | Apache 2.0 | Нашы GPU |
| F5-TTS | Кланаваньне голасу/ ператварэньне тэксту ў мову | MIT | Нашы GPU |
| all-MiniLM-L6-v2 | Comment=Убудаваны пошук у RAG | Apache 2.0 | Нашы GPU |
Мы не карыстаемся OpenAI, Anthropic, Google Cloud, або іншымі API LLM для якіх-небудзь функцый. Кожная вышэйзгаданая мадэль працуе на абсталяванні, якое мы валодаем і кіруем. Единственным знешнім сэрвісам AI, які мы выкарыстоўваем, з'яўляецца translateapi.ai (таксама Muddy Holdings) для перакладу радкоў інтэрфейсу карыстальніка - гэта ніколі не датычыцца вашага транслітаванага зместу.
Як мы раскрываем пакаленне ИИ
- Праграма для перакладу старонак HTML: уключыць < meta name=\
- Экспарт тэксту (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): уключыць радок загалоўка 'AI- generated transcript' у версе кожнага файла.
- Вывад сінтэзаванага голасу/ TTS: Файл WAV утрымлівае тэг'synthetic- voice' у метададзеных і яснае паведамленне на старонцы спампоўкі. На графіку ёсць адмоўная інфармацыя аб гукавых файлах.
- Адказы API: уключыць поле _ ai_ generated: true у кожны адказ JSON, які змяшчае перапісаны змест.
Дадзеныя трэніроўкі
- Базавыя мадэлі (Whisper, MadLAD, Qwen і інш.) паступаюць адпаведнымі выдаўцамі ў папярэдне падрыхтаваным выглядзе. Мы выкарыстоўваем іх у гатовым выглядзе.
- Вашы транскрыпты НЕ выкарыстоўваюцца для трэніроўкі базовых мадэляў.
- Калі вы выпраўляеце сегмент транскрыпцыі (паказваецца ў выглядзе малюнка) або пазначаеце яго як няправільны (паказваецца ў выглядзе сцягоў), І вы ўключылі ў / privacy- settings / (\
- Адпаведна, пераключальнік Дадаць карэкцыі і гук у Voice Lab (таксама ў / privacy- settings /, таксама па змаўчанні выключаны) дазваляе вам дадаць гук сегментаў, якія вы карэктуеце, у спалучэнні з выпраўленым тэкстам, у набор дадзеных Voice Lab пад CC- BY- SA- 4. 0. Гэтыя два пераключальнікі незалежныя — вы можаце дазволіць абодва, або ніводнага.
- Аўдыё, якое вы загрузілі, выдаляецца праз 24 гадзіны з дапамогай cleanup_ uploads cron - калі вы не ўключылі гэтае \
Дакладнасць і памылкі
Праграма для транскрыпцыі тэксту з дапамогай машыннага навучання не ідэальная. Частата памылак у словах залежыць ад акцэнту, якасці гуку, мовы і слоўніка. Для выкарыстання ў крытычнай сітуацыі (прававыя, медыцынскія, рэгуляваныя галіны) праверце з арыгінальным гукам. Нашы публічныя WER- эталоны для кожнай мадэлі знаходзяцца на /models/.
Пытанні аб адпаведнасці
Для пытанняў па законах ЕС аб штучным інтэлекце, GDPR або іншых пытаннях, звязаных з адпаведнасцю: hello@stt.ai або выкарыстаць Кантактная форма.
Апошняе абнаўленне: 2026-04-26.