Trancribeix amb STT.ai Enhanced
4.2%
WER
99
Idiomes
15.9x
Velocitat
MIT
Llicència
Quant a STT.ai Enhanced
STT.ai Millorat és el nostre model de veu més precís i més ràpid. Es construeix en l' arquitectura de transformació de documents amb optimitzacions propiàries, proporciona taxes d' error en la indústria que s' executen entre 100+ llengües. Ideal per a la transcripció de producció, títol real i aplicacions empreses.
✦ Desbloqueja el model millorat
Obtenir accés al nostre model més precís amb qualsevol pla pagat Ruchmu Ruket granv3, 99 llengües, i la dilarització de l'altaveu.
Visualitza Plans →Informació del model
- ProveïdorOpenAI (hosted by STT.ai)
- Arquitectura-
- LlicènciaMIT
- ActualitzatAug 2026
Preguntes més freqüents
STT.ai Enhanced és un model de text a text de text per OpenAI (hosted by STT.ai). STT.ai hosts STT.ai Enhanced en la nostra infraestructura de la GPU de manera que podeu usar- lo sense establir el vostre propi maquinari RTOcloc pujar àudio o vídeo i triar STT.ai Enhanced des del selector de models.
Sobre punts de referència estàndard, 8800 s' aconsegueix al voltant de 881% d' error de paraula. La precisió real del món depèn de la qualitat de l' àudio, de l' accent i del llenguatge; per a enregistraments amb soroll o amb accent, espereu uns quants percentatges més alts WER.
STT.ai Enhanced és un model de primera versió inclòs amb qualsevol pla pagat STT.ai que comenci en 5/ mesos. No està disponible en el liquador lliure: en comptes d' això, les pujades lliures i anònimes corren Rumors Turbo.
STT.ai Enhanced es deixa anar sota MIT, una llicència permissida de codi obert. Podeu autohost STT.ai Enhanced en el vostre propi maquinari o usar la nostra versió establishmenta tant és comercialment útil.
8800 dóna les llengües 8800. Auto- detecta l' idioma correcte per a la majoria d' àudio; també ho podeu especificar manualment per a un petit augment de precisió.
L' àudio de processos STT.ai Enhanced en quant a 15.9x real temps a les nostres GPUs. Un fitxer d' àudio d' 1 hora acaba en minuts 3; cua de fitxers més llarga i notificant per correu electrònic quan s' hagi fet.
STT.ai Enhanced té paràmetres 1.55B. Els models més grans tendeixen a ser més precisos però més lents; STT.ai hosts STT.ai Enhanced a la GPU per tant el nombre de paràmetres no afecta al vostre rendiment client- a costat.
STT.ai Enhanced accepta tots els formats STT.ai implementa el MP3, WAV, M4A, FLAC, OGG, MKV, MOV, AVI i altres. Sortida com TXT, SRT, VT, DOCX, JSON o PDF.
Sí. El President diarization s' executa junt amb STT.ai Enhanced per a cada recripció s' etiqueta per a cada altaveu i després els podeu reanomenar a l' editor.
Sí. 8800 s' executa en la nostra infraestructura privada es processa i s' esborra per omissió. Pro+ afegeix encriptatge a l' altre costat de manera que les transcripcions de clients no són illegibles sense la vostra clau, i el Cloud privat us permet auto- 8800 dòlars completament a la vostra pròpia vicepresidentC.
Useu l' eina Compara- t per executar STT.ai Enhanced contra qualsevol altre model acceptat en el mateix model d' àudio 2001- 2002 veureu WEP, nombre de segments, etiquetes d' altaveu i puntuacions de confiança al costat. La comparació STT.ai Enhanced contra RR3 és la més comuna.
Sí. Especifiqueu "stt-ai-enhanced0" com a paràmetre del model en el punt d' acabament / v1/trancrib. Python i Node. js SDKs inclouen 881 exemples. L' API lliure inclou 100 minuts/ mesos.
Sí. Perquè la pàgina de codi obert STT.ai Enhanced és MIT- license- license, podeu fer- la en si mateix. La pàgina de codi obert STT.ai llista les llistes de la plataforma i els pesos. La majoria d' equips de producció usen la nostra versió allotjada per saltar la GPU, els canvis i les operacions.