Прагляд

У 1999 годзе ўступіў у сілу закон аб абароне правоў і свабод чалавека, які ўвёў у дзеянне артыкул 20 (208-209).

Дрэва

  • Усе транскрыпцыі створаны AI. Кожны вывад нясе машыначытабельную інфармацыю.
  • Усе AI працуе на нашым уласным GPU. Мы НЕ адпраўляем ваш аўдыё або тэкст у OpenAI, Anthropic, Google, або любы трэці LLM API.
  • Мы НЕ трэніруем ніякія мадэлі на вашых транскрыптах. Кожная мадэль, якую мы запускаем, з' яўляецца мадэллю з адкрытым зыходным кодам. Выпраўленні, якія вы выразна робіце, збіраюцца толькі калі вы дазволілі гэта.
  • Сінтэтычныя галасавыя клоны (TTS) выразна пазначаны як AI-генераваныя ў імя файла, метададзеных і на старонцы.

Модулі, якія мы выкарыстоўваем

МодульВыкарыстоўваецца дляЛіцэнзіяЗапушчана
Whisper large-v3-turbo (faster-whisper)ПраграмаMITНашы GPU
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”Транскрипция (платная)MITНашы GPU
VoskПрагляд словаў у рэальным часеApache 2.0Нашы GPU
SpeechBrain ECAPA-TDNNДыялогавае акноApache 2.0Нашы GPU
MadLAD-400 3BПераклад (450+ моў) NameApache 2.0Нашы GPU
Qwen2.5-1.5B (llama.cpp)Падрабязнасьці, аналіз, стварэньне зьместу, RAG- чатApache 2.0Нашы GPU
F5-TTSКланаваньне голасу/ ператварэньне тэксту ў мовуMITНашы GPU
all-MiniLM-L6-v2Comment=Убудаваны пошук у RAGApache 2.0Нашы GPU

“STT.ai Enhanced” is our product name for Whisper large-v3 running on our own GPU. It is not a custom model, a fine-tune, or proprietary weights — it is the largest and most accurate Whisper checkpoint. It is more accurate than the default Whisper large-v3-turbo, and about 1.5x slower on a diarized job, measured on our own hardware.

Мы не карыстаемся OpenAI, Anthropic, Google Cloud, або іншымі API LLM для якіх-небудзь функцый. Кожная вышэйзгаданая мадэль працуе на абсталяванні, якое мы валодаем і кіруем. Единственным знешнім сэрвісам AI, які мы выкарыстоўваем, з'яўляецца translateapi.ai (таксама Muddy Holdings) для перакладу радкоў інтэрфейсу карыстальніка - гэта ніколі не датычыцца вашага транслітаванага зместу.

Як мы раскрываем пакаленне ИИ

  • Праграма для перакладу старонак HTML: уключыць < meta name=\
  • Экспарт тэксту (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): уключыць радок загалоўка 'AI- generated transcript' у версе кожнага файла.
  • Вывад сінтэзаванага голасу/ TTS: Файл WAV утрымлівае тэг'synthetic- voice' у метададзеных і яснае паведамленне на старонцы спампоўкі. На графіку ёсць адмоўная інфармацыя аб гукавых файлах.
  • Адказы API: уключыць поле _ ai_ generated: true у кожны адказ JSON, які змяшчае перапісаны змест.

Дадзеныя трэніроўкі

  • Базавыя мадэлі (Whisper, MadLAD, Qwen і інш.) паступаюць адпаведнымі выдаўцамі ў папярэдне падрыхтаваным выглядзе. Мы выкарыстоўваем іх у гатовым выглядзе.
  • Вашы транскрыпты НЕ выкарыстоўваюцца для трэніроўкі базовых мадэляў.
  • Калі вы выпраўляеце сегмент транскрыпту (знак пэндзля) або пазначаеце яго як няправільны (знак сцягоў), І вы ўключылі ў / privacy- settings / (па змаўчанні выключана), пара (неправільны тэкст → выпраўлены тэкст) можа быць сабраная для трэніроўкі будучага мадэлі тэкставага карэкціроўкі. Толькі тэкставая пара - ніколі акружаючыя гукавыя файлы - выкарыстоўваюцца гэтым шляхам. Такіх мадэляў не існуе: пары толькі захоўваюцца, і нічога, што мы ў цяперашні час абслугоўваем, не было трэніраванае на іх.
  • Адпаведна, пераключальнік Дадаць карэкцыі і гук у Voice Lab (таксама ў / privacy- settings /, таксама па змаўчанні выключаны) дазваляе вам дадаць гук сегментаў, якія вы карэктуеце, у спалучэнні з выпраўленым тэкстам, у набор дадзеных Voice Lab пад CC- BY- SA- 4. 0. Гэтыя два пераключальнікі незалежныя — вы можаце дазволіць абодва, або ніводнага.
  • Аўдыё, якое вы загрузілі, выдаляецца праз 24 гадзіны з дапамогай cleanup_ uploads cron - калі вы не ўключылі гэтае \

Дакладнасць і памылкі

Праграма для транскрыпцыі тэксту з дапамогай машыннага навучання не ідэальная. Частата памылак у словах залежыць ад акцэнту, якасці гуку, мовы і слоўніка. Для выкарыстання ў крытычнай сітуацыі (прававыя, медыцынскія, рэгуляваныя галіны) праверце з арыгінальным гукам. Нашы публічныя WER- эталоны для кожнай мадэлі знаходзяцца на /models/.

Пытанні аб адпаведнасці

Для пытанняў па законах ЕС аб штучным інтэлекце, GDPR або іншых пытаннях, звязаных з адпаведнасцю: hello@stt.ai або выкарыстаць Кантактная форма.

Апошняе абнаўленне: 2026-08-05.