Прагляд

У 1999 годзе ўступіў у сілу закон аб абароне правоў і свабод чалавека, які ўвёў у дзеянне артыкул 20 (208-209).

Дрэва

  • Усе транскрыпцыі створаны AI. Кожны вывад нясе машыначытабельную інфармацыю.
  • Усе AI працуе на нашым уласным GPU. Мы НЕ адпраўляем ваш аўдыё або тэкст у OpenAI, Anthropic, Google, або любы трэці LLM API.
  • Мы НЕ трэніруем базу мадэляў на вашых транскрыптах. Толькі ўключэнне дакладнай наладкі выкарыстоўвае карэкцыі, якія вы выразна зрабілі.
  • Сінтэтычныя галасавыя клоны (TTS) выразна пазначаны як AI-генераваныя ў імя файла, метададзеных і на старонцы.

Модулі, якія мы выкарыстоўваем

МодульВыкарыстоўваецца дляЛіцэнзіяЗапушчана
Whisper large-v3-turbo (faster-whisper)ПраграмаMITНашы GPU
STT.ai Enhanced (custom fine-tune)Транскрипция (платная)MIT (base) / Proprietary (fine-tune weights)Нашы GPU
VoskПрагляд словаў у рэальным часеApache 2.0Нашы GPU
SpeechBrain ECAPA-TDNNДыялогавае акноApache 2.0Нашы GPU
MadLAD-400 3BПераклад (450+ моў) NameApache 2.0Нашы GPU
Qwen2.5-1.5B (llama.cpp)Падрабязнасьці, аналіз, стварэньне зьместу, RAG- чатApache 2.0Нашы GPU
F5-TTSКланаваньне голасу/ ператварэньне тэксту ў мовуMITНашы GPU
all-MiniLM-L6-v2Comment=Убудаваны пошук у RAGApache 2.0Нашы GPU

Мы не карыстаемся OpenAI, Anthropic, Google Cloud, або іншымі API LLM для якіх-небудзь функцый. Кожная вышэйзгаданая мадэль працуе на абсталяванні, якое мы валодаем і кіруем. Единственным знешнім сэрвісам AI, які мы выкарыстоўваем, з'яўляецца translateapi.ai (таксама Muddy Holdings) для перакладу радкоў інтэрфейсу карыстальніка - гэта ніколі не датычыцца вашага транслітаванага зместу.

Як мы раскрываем пакаленне ИИ

  • Праграма для перакладу старонак HTML: уключыць < meta name=\
  • Экспарт тэксту (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): уключыць радок загалоўка 'AI- generated transcript' у версе кожнага файла.
  • Вывад сінтэзаванага голасу/ TTS: Файл WAV утрымлівае тэг'synthetic- voice' у метададзеных і яснае паведамленне на старонцы спампоўкі. На графіку ёсць адмоўная інфармацыя аб гукавых файлах.
  • Адказы API: уключыць поле _ ai_ generated: true у кожны адказ JSON, які змяшчае перапісаны змест.

Дадзеныя трэніроўкі

  • Базавыя мадэлі (Whisper, MadLAD, Qwen і інш.) паступаюць адпаведнымі выдаўцамі ў папярэдне падрыхтаваным выглядзе. Мы выкарыстоўваем іх у гатовым выглядзе.
  • Вашы транскрыпты НЕ выкарыстоўваюцца для трэніроўкі базовых мадэляў.
  • Калі вы выпраўляеце сегмент транскрыпцыі (паказваецца ў выглядзе малюнка) або пазначаеце яго як няправільны (паказваецца ў выглядзе сцягоў), І вы ўключылі ў / privacy- settings / (\
  • Адпаведна, пераключальнік Дадаць карэкцыі і гук у Voice Lab (таксама ў / privacy- settings /, таксама па змаўчанні выключаны) дазваляе вам дадаць гук сегментаў, якія вы карэктуеце, у спалучэнні з выпраўленым тэкстам, у набор дадзеных Voice Lab пад CC- BY- SA- 4. 0. Гэтыя два пераключальнікі незалежныя — вы можаце дазволіць абодва, або ніводнага.
  • Аўдыё, якое вы загрузілі, выдаляецца праз 24 гадзіны з дапамогай cleanup_ uploads cron - калі вы не ўключылі гэтае \

Дакладнасць і памылкі

Праграма для транскрыпцыі тэксту з дапамогай машыннага навучання не ідэальная. Частата памылак у словах залежыць ад акцэнту, якасці гуку, мовы і слоўніка. Для выкарыстання ў крытычнай сітуацыі (прававыя, медыцынскія, рэгуляваныя галіны) праверце з арыгінальным гукам. Нашы публічныя WER- эталоны для кожнай мадэлі знаходзяцца на /models/.

Пытанні аб адпаведнасці

Для пытанняў па законах ЕС аб штучным інтэлекце, GDPR або іншых пытаннях, звязаных з адпаведнасцю: hello@stt.ai або выкарыстаць Кантактная форма.

Апошняе абнаўленне: 2026-04-26.