Ingeskryf met STT.ai Enhanced
4.2%
WER
99
Tale
15.9x
Spoed
MIT
Lisensie
Aangaande STT.ai Enhanced
STT.ai Verbetering is ons akkuraatste en vinnigste spraak-tot-teks model. Gebou op sny-ge transformatorsion bou argitektuur met pipletions, dit lewer industrie-bemiddelde woord foutkoerse oor 100+ tale. Ideale vir produksie transkripsie, werklike-tyd-opskrif, en ondernemingstoepassings.
✦ Ontsluit verbeterde model
Kry toegang tot ons akkuraatste model met enige betaalde plan ${ Whisper groot-v3, 99 tale en spreker diarisering.
Besigtig Planne →Model InligtingName
- VerskafferOpenAI (hosted by STT.ai)
- Argitektuur-
- LisensieMIT
- OpgedateerCancel: Meeting NameMeetingAug 2026
Vrae wat dikwels gevra word
STT.ai Enhanced is 'n spraak-na-teksmodel met OpenAI (hosted by STT.ai). STT.ai gashere van ons GPU-fu-U-fustrasie sodat jy dit kan gebruik sonder om jou eie hardeware te verskaf ooit klank of video op te laai en STT.ai Enhanced van die modelpikkel te kies.
Op standaard bankmerke bereik STT.ai Enhanced om 4.2% Woord Fout tempo. Real-world akkuraatheid hang af van klankgehalte, aksent en taal; vir lawaaierige of gefluurde opnames, verwag 'n paar persentasie punte hoër WER.
STT.ai Enhanced is'n premies model verblyd met enige betaalde STT.ai plan wat by $5/month begin. Dit is nie beskikbaar op die vry vlak: vry en anonieme oplaaile hardloop Whisper Turbo in plaas daarvan.
STT.ai Enhanced word vrygestel onder MIT, 'n permissiewe open-onse lisensie. Jy kan self-host STT.ai Enhanced op jou eie hardeware of gebruik ons gegasheer weergawe 2 is kommersieel bruikbaar.
STT.ai Enhanced ondersteun 99 tale. Outo-speur die regte taal vir die meeste oudio; u kan dit ook self spesifiseer vir 'n klein akkuraatheid.
STT.ai Enhanced verwerk klank oor ongeveer 15.9x real-time op ons GPUs. 'n 1-hour klank lêer eindig onder 3 minute; langer lêers wag en inkennis stel deur e-pos wanneer dit gedoen word.
STT.ai Enhanced het 1.55B parameters. Groter modelle is geneig om akkurater maar stadiger te wees; STT.ai-gashere STT.ai Enhanced op GPU sodat die parametertelling nie jou kliënt-side-prestasie beïnvloed nie.
STT.ai Enhanced accepts every format STT.ai supports — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, and others. Output as TXT, SRT, VTT, DOCX, JSON, or PDF.
Ja, Speaker diarisering loop langs STT.ai Enhanced vir elke transkripsie ium ium word elke spreker gemerk en jy kan hulle na die volgende in die redigeerder hernoem.
Ja. STT.ai Enhanced loop in ons privaat infrastruktuur Lazlo-oudio word verwerk en uitgevee deur verstek. Pro+ voeg kliënt-side enkripsies by sodat transkripsies nie beskikbaar is sonder jou sleutel nie, en Private wolk laat jou self-host STT.ai Enhanced heeltemal in jou eie VPC.
Gebruik die vergelyk-stel gereedskap om STT.ai Enhanced te laat loop teen enige ander ondersteunde model op dieselfde oudio DVD jy sal sien WER, segment tel, luidspreker etikette en vertroue punte kant- by-side. die STT.ai Enhanced vs Whift Groot V3 vergelyking is die algemeenste hardloop.
Ja. Spesifiseer "stt-ai-enhanced" as die model parameter op die /v1/aanteken eindepunt. Python en Node.js SDKs sluit 8800 voorbeelde in. Vry 'nPI-vlak sluit 100 minute/month in.
Ja. Omdat STT.ai Enhanced MIT-licensed is, kan jy self-host dit. STT.ai se ope-bou-blad gee 'n lys van die projek repo en gewigte. Mees produksiespanne gebruik ons gemoÃ" weergawe om GPU-berigting, model ruilinge en eeps te laat vaar.