Прагляд
У 1999 годзе ўступіў у сілу закон аб абароне правоў і свабод чалавека, які ўвёў у дзеянне артыкул 20 (208-209).
Дрэва
- Усе транскрыпцыі створаны AI. Кожны вывад нясе машыначытабельную інфармацыю.
- Усе AI працуе на нашым уласным GPU. Мы НЕ адпраўляем ваш аўдыё або тэкст у OpenAI, Anthropic, Google, або любы трэці LLM API.
- Мы НЕ трэніруем ніякія мадэлі на вашых транскрыптах. Кожная мадэль, якую мы запускаем, з' яўляецца мадэллю з адкрытым зыходным кодам. Выпраўленні, якія вы выразна робіце, збіраюцца толькі калі вы дазволілі гэта.
- Сінтэтычныя галасавыя клоны (TTS) выразна пазначаны як AI-генераваныя ў імя файла, метададзеных і на старонцы.
Модулі, якія мы выкарыстоўваем
| Модуль | Выкарыстоўваецца для | Ліцэнзія | Запушчана |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Праграма | MIT | Нашы GPU |
| Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced” | Транскрипция (платная) | MIT | Нашы GPU |
| Vosk | Прагляд словаў у рэальным часе | Apache 2.0 | Нашы GPU |
| SpeechBrain ECAPA-TDNN | Дыялогавае акно | Apache 2.0 | Нашы GPU |
| MadLAD-400 3B | Пераклад (450+ моў) Name | Apache 2.0 | Нашы GPU |
| Qwen2.5-1.5B (llama.cpp) | Падрабязнасьці, аналіз, стварэньне зьместу, RAG- чат | Apache 2.0 | Нашы GPU |
| F5-TTS | Кланаваньне голасу/ ператварэньне тэксту ў мову | MIT | Нашы GPU |
| all-MiniLM-L6-v2 | Comment=Убудаваны пошук у RAG | Apache 2.0 | Нашы GPU |
“STT.ai Enhanced” is our product name for Whisper large-v3 running on our own GPU. It is not a custom model, a fine-tune, or proprietary weights — it is the largest and most accurate Whisper checkpoint. It is more accurate than the default Whisper large-v3-turbo, and about 1.5x slower on a diarized job, measured on our own hardware.
Мы не карыстаемся OpenAI, Anthropic, Google Cloud, або іншымі API LLM для якіх-небудзь функцый. Кожная вышэйзгаданая мадэль працуе на абсталяванні, якое мы валодаем і кіруем. Единственным знешнім сэрвісам AI, які мы выкарыстоўваем, з'яўляецца translateapi.ai (таксама Muddy Holdings) для перакладу радкоў інтэрфейсу карыстальніка - гэта ніколі не датычыцца вашага транслітаванага зместу.
Як мы раскрываем пакаленне ИИ
- Праграма для перакладу старонак HTML: уключыць < meta name=\
- Экспарт тэксту (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): уключыць радок загалоўка 'AI- generated transcript' у версе кожнага файла.
- Вывад сінтэзаванага голасу/ TTS: Файл WAV утрымлівае тэг'synthetic- voice' у метададзеных і яснае паведамленне на старонцы спампоўкі. На графіку ёсць адмоўная інфармацыя аб гукавых файлах.
- Адказы API: уключыць поле _ ai_ generated: true у кожны адказ JSON, які змяшчае перапісаны змест.
Дадзеныя трэніроўкі
- Базавыя мадэлі (Whisper, MadLAD, Qwen і інш.) паступаюць адпаведнымі выдаўцамі ў папярэдне падрыхтаваным выглядзе. Мы выкарыстоўваем іх у гатовым выглядзе.
- Вашы транскрыпты НЕ выкарыстоўваюцца для трэніроўкі базовых мадэляў.
- Калі вы выпраўляеце сегмент транскрыпту (знак пэндзля) або пазначаеце яго як няправільны (знак сцягоў), І вы ўключылі ў / privacy- settings / (па змаўчанні выключана), пара (неправільны тэкст → выпраўлены тэкст) можа быць сабраная для трэніроўкі будучага мадэлі тэкставага карэкціроўкі. Толькі тэкставая пара - ніколі акружаючыя гукавыя файлы - выкарыстоўваюцца гэтым шляхам. Такіх мадэляў не існуе: пары толькі захоўваюцца, і нічога, што мы ў цяперашні час абслугоўваем, не было трэніраванае на іх.
- Адпаведна, пераключальнік Дадаць карэкцыі і гук у Voice Lab (таксама ў / privacy- settings /, таксама па змаўчанні выключаны) дазваляе вам дадаць гук сегментаў, якія вы карэктуеце, у спалучэнні з выпраўленым тэкстам, у набор дадзеных Voice Lab пад CC- BY- SA- 4. 0. Гэтыя два пераключальнікі незалежныя — вы можаце дазволіць абодва, або ніводнага.
- Аўдыё, якое вы загрузілі, выдаляецца праз 24 гадзіны з дапамогай cleanup_ uploads cron - калі вы не ўключылі гэтае \
Дакладнасць і памылкі
Праграма для транскрыпцыі тэксту з дапамогай машыннага навучання не ідэальная. Частата памылак у словах залежыць ад акцэнту, якасці гуку, мовы і слоўніка. Для выкарыстання ў крытычнай сітуацыі (прававыя, медыцынскія, рэгуляваныя галіны) праверце з арыгінальным гукам. Нашы публічныя WER- эталоны для кожнай мадэлі знаходзяцца на /models/.
Пытанні аб адпаведнасці
Для пытанняў па законах ЕС аб штучным інтэлекце, GDPR або іншых пытаннях, звязаных з адпаведнасцю: hello@stt.ai або выкарыстаць Кантактная форма.
Апошняе абнаўленне: 2026-08-05.