Переписка STT.ai Enhanced
3.2%
WER
100
Знание языков
160.0x
Скорость
Proprietary
Лицензия
О том, что STT.ai Enhanced
STT.ai Расширенная - это наша наиболее точная и быстрая модель речи-текста. Построена на передовой трансформаторной архитектуре с запатентованной оптимизацией, она обеспечивает показатели ошибок в словах на 100+ языках. Идеалы для транскрипции производства, субтитров в реальном времени и приложений для предприятий.
Языки, поддерживаемые STT.ai Enhanced
✦ Отключить усовершенствованную модель
Получите доступ к нашей наиболее точной модели с любым оплачиваемым планом. 3,2% WER, 160x скорости в реальном времени, 100+ языков.
Просмотр →Модель
- ПоставщикSTT.ai
- Архитектура-
- ЛицензияProprietary
- ОбновленныеMar 2026
Часто задаваемые вопросы
STT.ai Enhanced — это речевая модель на STT.ai. STT.ai носит STT.ai Enhanced на нашей инфраструктуре GPU, так что вы можете использовать ее без обеспечения собственного оборудования — загружать аудио- или видео и выбирать STT.ai Enhanced из сборщика модели.
При стандартных контрольных параметрах STT.ai Enhanced достигает примерно 3.2% скорости ошибок в Word. Точность в реальном мире зависит от качества звука, акцента и языка; для шумных или заостренных записей ожидается, что на несколько процентных пунктов выше WER.
STT.ai Enhanced является премиальной моделью, которая включает в себя любой оплаченный план STT.ai начиная с 5 долл. США в месяц. Бесплатные пользователи могут презентовать STT.ai Enhanced на коротких клипах; более длинные файлы требуют активного плана.
STT.ai Enhanced распространяется под номером Proprietary. Устроенная версия STT.ai обеспечивает соблюдение лицензии для вас, так что коммерческое использование через нашу службу является простым.
STT.ai Enhanced поддерживает 100 язык. Автообнаружение выбирает правильный язык для большинства звуков; вы также можете указать его вручную для небольшого лифта с точностью.
STT.ai Enhanced обрабатывает аудио примерно 160.0x в режиме реального времени на наших GPU. 1-часовой аудио файл заканчивается меньше чем за 1 минуты; более длинный список файлов и уведомление по электронной почте, когда он будет сделан.
STT.ai Enhanced имеет параметры 1.5B. Большие модели, как правило, более точны, но медленнее; STT.ai носит STT.ai Enhanced на GPU, так что число параметров не влияет на производительность вашего клиента.
STT.ai Enhanced принимает каждый формат STT.ai поддержки — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI и другие.
Да, диааризация спикера проводится вместе с STT.ai Enhanced за каждую транскрипцию — каждый оратор помечен ярлыком, и после этого вы можете переименовать их в редактора.
Да. STT.ai Enhanced прогонов в нашей частной инфраструктуре — аудио обрабатывается и удаляется по умолчанию. Про+ добавляет шифрование клиентом, так что стенограммы невозможно прочесть без ключа, и Private Cloud позволяет вам вести STT.ai Enhanced полностью в вашем собственном VPC.
Используйте инструмент для сравнения с STT.ai Enhanced против любой другой поддерживаемой модели на одном и том же аудио — вы увидите WER, число сегментов, ярлыки громкостей и оценки достоверности одновременно. Сопоставление STT.ai Enhanced vs Whisper Крупный V3 — наиболее частое сравнение.
Да. Указать "stt-ai-enhanced" в качестве параметра модели на конечных точках /v1/tranarip. Python и Node.js SDKs включают STT.ai Enhanced примеры. Свободный API уровень включает 100 минут в месяц.
Лицензирование на STT.ai Enhanced установлено на STT.ai; самопринимательство зависит от их условий. STT.ai хост-сервис работает на Управленном GPU, так что вам не нужно управлять этой интеграцией.