Transcriure amb STT.ai Enhanced
4.2%
WER
99
Lengas
15.9x
Velocitat
MIT
Licéncia
A prepaus de STT.ai Enhanced
STT.ai Enhanced es lo nòstre modèl de sintèsi vocala mai precis e mai rapid. Construch sus una arquitectura de transformador de ponch amb d'optimizacions proprietarias, dona de taus d'error de mots de primièra classa dins mai de 100 lengas. Ideal per la transcripcion de produccion, los sostítols en temps real e las aplicacion d'entrepresa.
✦ @ info: status
Accedissètz al nòstre modèl mai precis amb quin plan pagat que siá - Whisper large-v3, 99 lengas, e diarisacion dels locutors.
Visualizar los plans →Entresenhas sul modèl
- ProvesidorOpenAI (hosted by STT.ai)
- Arquitectura-
- LicénciaMIT
- ActualizatAug 2026
Questions frequentas
STT.ai Enhanced es un modèl de sintèsi vocala de OpenAI (hosted by STT.ai). STT.ai aloja STT.ai Enhanced sus nòstra infrastructura GPU per que pòsca èsser utilizat sens provisionar vòstre pròpri maquinari - cargatz l'audio o la vidèo e causit STT.ai Enhanced dins lo selector de modèls.
@ info
STT.ai Enhanced es un modèl premium — inclus dins totes los plans pagats STT.ai a partir de $5/mes. Es pas disponible dins lo nivèl liure: los uploads liures e anonims utilizan Whisper Turbo.
STT.ai Enhanced es publicat jos la licéncia MIT, una licéncia de còde dobèrt permissiva. Podètz auto-ostejar STT.ai Enhanced sus vòstre pròpri maquinari o utilizar nòstra version ostejada — ambedos son comercialament utilizables.
STT.ai Enhanced pren en carga 99 lengas. La deteccion automatica causís la lenga correcta per la majoritat dels sons; podètz tanben la especificar manualament per una precision melhorada.
STT.ai Enhanced traça l'audio a aperaquí 15.9x en temps real sus nòstras GPU. Un fichièr àudio d'una ora se acaba en mens de 3 minutas; los fichièrs mai longs son plaçats en fila e notificats per corrièr electronic quand son acabats.
STT.ai Enhanced a de paramètres 1.55B. Los modèls mai grands son mai precises mas mai lents; STT.ai òste STT.ai Enhanced sul GPU, doncas lo compte de paramètres afecta pas vòstras performanças del costat client.
STT.ai Enhanced accepta totes los formats que pren en carga STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, e d'autres. Sortida coma TXT, SRT, VTT, DOX, JSON, o PDF.
@ info: shell
Òc. STT.ai Enhanced s'exécuta dins nòstra infrastructura privada — l'audio es tractat e suprimit per defaut. Pro+ apond un criptatge del costat client per que las transcripcions sián illegiblas sens vòstra clau, e Private Cloud vos permet d'ostejar STT.ai Enhanced entièrament dins vòstra pròpria VPC.
Utilizatz l'aisina compare-stt per comparar STT.ai Enhanced amb quin autre modèl suportat sul meteis audio — veiretz WER, lo comptatge de segments, las etiquetas dels parlants e las pontuacions de fiabilitat a costat. La comparason STT.ai Enhanced vs Whisper Large V3 es la mai comuna.
Òc. Especifiquez "stt-ai-enhanced" coma paramètre del modèl sul punt de fin /v1/transcribe. Los SDK Python e Node.js incluson d'exemples STT.ai Enhanced. Lo nivèl API liure inclutz 100 minutas/mes.
Òc. Perque STT.ai Enhanced es licenciat amb MIT, podètz l'albergar. La pagina de còde dobèrt de STT.ai lista lo repositori e los pes del projècte. La majoritat de las equipas de produccion utilizan nòstra version albergada per passar l'aquisicion de GPU, los escambis de modèls e las operacions.