Переписатися на STT.ai Enhanced
4.2%
WER
99
Мови
15.9x
Швидкість
MIT
Ліцензія
Про програму STT.ai Enhanced
STT.ai - це найточніша і найшвидкісніша модель мовлення з тексту. Вона побудована на архітектурі трансформатора з профілактичною оптимізацією, вона забезпечує рівень помилки слів, що є промисловими, серед 100 мовами. Ідеалізація для виробничих архівів, створення підписів у режимі реального часу та програм для ведення бізнесу.
Мови, що підтримуються STT.ai Enhanced
✦ Розблокувати розширену модель
Отримати доступ до нашої найбільш точної моделі з будь-яким оплачуваним планом ♫ Whsper gress-v3, 99 мов, і диалізування промовця.
Перегляд Плани →Інформація про модель
- ПровайдерOpenAI (hosted by STT.ai)
- Архітектура-
- ЛіцензіяMIT
- ОновленоAug 2026
Часті запитання
STT.ai Enhanced is a speech-to-text model by OpenAI (hosted by STT.ai). STT.ai hosts STT.ai Enhanced on our GPU infrastructure so you can use it without provisioning your own hardware — upload audio or video and pick STT.ai Enhanced from the model picker.
За стандартними полями STT.ai Enhanced досягає приблизно 4.2% Частота помилок за словами. Точність реального світу залежить від якості звуку, акценту та мови; для галасливих або акцентованих записів очікується на декількох відсоткових пунктах вищого WER.
STT.ai Enhanced is a premium model — included with any paid STT.ai plan starting at $5/month. It is not available on the free tier: free and anonymous uploads run Whisper Turbo instead.
STT.ai Enhanced is released under MIT, a permissive open-source license. You can self-host STT.ai Enhanced on your own hardware or use our hosted version — both are commercially usable.
STT.ai Enhanced підтримують 99 мови. Автовиявлення обирає правильну мову для більшості звукових файлів; ви також можете вказати її вручну для невеличкого підйому точності.
STT.ai Enhanced processes audio at about 15.9x real-time on our GPUs. A 1-hour audio file finishes in under 3 minutes; longer files queue and notify by email when done.
STT.ai Enhanced має 8882 параметри. Великі моделі зазвичай є точнішими, але повільнішими; STT.ai вузлів - STT.ai Enhanced на GPU, отже кількість параметрів не впливає на швидкодію вашого клієнта.
STT.ai Enhanced приймає кожен формат STT.ai підтримує MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI та інші. Вивід у вигляді TXT, SRT, VTT, DOCX, JSON або PDF.
Так. diamer diaarization працює поряд STT.ai Enhanced на кожен запис, кожен з промов буде позначено, і ви зможете перейменувати їх у редакторі після цього.
Yes. STT.ai Enhanced runs in our private infrastructure — audio is processed and deleted by default. Pro+ adds client-side encryption so transcripts are unreadable without your key, and Private Cloud lets you self-host STT.ai Enhanced entirely in your own VPC.
Скористайтеся інструментом порівняння- stest, щоб запустити STT.ai Enhanced у порівнянні з будь- якою іншою моделлю, що підтримується, на одному і тому ж звуковому каналі, ви побачите WER, кількість сегментів, надписи промовців, а також результати довіри збоку. Порівняння STT.ai Enhanced проти Wisper Великий V3 є найбільш поширеним.
Так. Вкажіть " stt-ai-enhanced " як параметр моделі у теці / v1/ trancess кінцевій точці. У назвах Python і вузла. js SDKs містяться STT.ai Enhanced приклади. У вільний інтерфейс API міститься 100 хвилин/ місяців.
Так. Оскільки STT.ai Enhanced має 8882- ліцензію, ви можете виконати її. STT.ai - на сторінці з відкритим кодом наведено список експропріаторів та ваг. Більшість команд з виробництва використовують нашу власницьку версію для того, щоб пропустити закупівлю на GPU, моделі свопінгу і ops.