IA Политика и транспарентность

Что мы используем для ИИ, где она работает и как мы соблюдаем требования о раскрытии информации (статья 50 Закона ЕС об МА, вступившая в силу 2026-08-02).

TL; DR

  • Все записи составлены АИ.
  • Все АИ работают на нашем ГИП. Мы не отправляем ваш аудио- или текст в OpenAI, Anthropic, Google или любую третью сторону LLM API.
  • Мы не обучаем базовые модели в ваших протоколах, только в идеальном варианте используются исправления, которые вы делаете.
  • Синтетические голосовые клоны (TTS) четко обозначены как AI-образные в имени файла, метаданных и на странице.

Модели, которые мы используем

МодельИспользуется дляЛицензияБегает
Whisper large-v3-turbo (faster-whisper)Переписка (неисполнение)MITНаша ГПУ
STT.ai Enhanced (custom fine-tune)Переписка (оплачиваемые планы)MIT (base) / Proprietary (fine-tune weights)Наша ГПУ
VoskВ реальном времениApache 2.0Наша ГПУ
SpeechBrain ECAPA-TDNNДиарея спикераApache 2.0Наша ГПУ
MadLAD-400 3BПисьменный перевод (450+ языков)Apache 2.0Наша ГПУ
Qwen2.5-1.5B (llama.cpp)Резюме, анализ, подготовка содержания, чат RAGApache 2.0Наша ГПУ
F5-TTSКлонирование голоса/текст-скрипMITНаша ГПУ
all-MiniLM-L6-v2Приобретение для поиска в КРИApache 2.0Наша ГПУ

Мы не называем OpenAI, Anthropic, Google Cloud или любую третью сторону LLM API для любой функции. Каждая модель выше работает на аппаратных средствах, которыми мы владеем и работаем. Единственная внешняя служба AI, которую мы используем, это переводапи.ai (также Muddy Holdings) для перевода струн UI — это никогда не касается вашего транскрибированного контента.

Как мы раскрываем поколение АИ

  • Страницы HTML: включаю <мета имя#\
  • Экспорт текстов (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): Включите заголовок "AI-Record" в верхней части каждого файла.
  • Выход синтетического голоса/TTS: В файлах WAV есть тег "синтетического счета-фактуры" в метаданных и четкое уведомление на странице загрузки. Звуковая отмена включена в дорожную карту.
  • Ответы АПИ: Включите "ai_" в каждое поле реакции JSON, которое содержит транскрибированное содержание.

Данные о профессиональной подготовке

  • Базовые модели (шеппер, МэдЛАД, Квен и т.д.) проходят предварительную подготовку у их соответствующих издателей.
  • Ваши записи не используются для обучения базовых моделей.
  • Если вы исправляете стенограмму (значок карандаша) или наметите ее неправильно (значок флага), и вы сделали выбор в /привати-фикс/ (\
  • Помимо этого, исправления, внесенные в программу Голосовой Лаборатории, плюс аудиозаписи (также в /privaty-regings/, также по умолчанию), делают выбор в пользу передачи звука сегментов, которые вы корректируете, в паре с исправленным текстом, в наш набор данных Voice Lab в CC-BY-SA-4. Два таблетки независимы — вы можете предоставить либо оба, либо ни то, ни другое.
  • Аудиозапись удаляется в течение 24 часов через хрон для очистки — UNLESS, в который вы сделали выбор \

Точность и ошибки

Публикации AI не совершенны. Показатели ошибок в словах варьируются в зависимости от акцента, качества звука, языка и словаря доменов. Для критического использования (юридические, медицинские, регулируемые отрасли) проверяйте с точки зрения оригинального аудио. Наши публичные показатели WER на модель находятся на уровне /models/.

Вопросы соблюдения

Для Закона ЕС об ИИ, Закона о ВВПР или других вопросов соблюдения: hello@stt.ai или использовать бланк контакта.

Последнее обновление: 2026-04-26.