Átírás STT.ai Enhanced
4.2%
WER
99
Nyelvek
15.9x
Sebesség
MIT
Engedély
About STT.ai Enhanced
STT.ai Enhanced a mi legpontosabb és leggyorsabb beszéd-szöveg modell. Beépített élvonalbeli transzformátor architektúra szabadalmaztatott optimalizálás, szállít ipari vezető szó hiba arány a 100+ nyelvek. Ideális a gyártás átírása, valós idejű feliratozás, és vállalati alkalmazások.
✦ Kinyitja a továbbfejlesztett modellt
Hozzáférés a legpontosabb modell bármilyen fizetett terv • Whisper nagy-v3, 99 nyelvek, és hangszóró diarization.
A terv megtekintése →Adatminta
- SzolgáltatóOpenAI (hosted by STT.ai)
- Építészet-
- EngedélyMIT
- FrissítveAug 2026
Gyakran ismételt kérdések
STT.ai Enhanced egy beszéd-to-text modell OpenAI (hosted by STT.ai), STT.ai hosts STT.ai Enhanced a mi GPU infrastruktúra, így használhatja anélkül, hogy a saját hardvere feltölti audio vagy videó, és vegye STT.ai Enhanced a modell picker.
A standard referenciaértékek, STT.ai Enhanced eléri mintegy 4.2%-os Word Error Rate. A valós világ pontossága függ a hangminőség, az akcentus és a nyelv; a zajos vagy kihangsúlyozott felvételek, számíthat néhány százalékponttal magasabb WER.
STT.ai Enhanced egy prémium modell • tartalmazza minden fizetett STT.ai terv indul $5 hónap. Nem áll rendelkezésre a szabad szint: ingyenes és névtelen feltöltések fut Whisper Turbo helyett.
STT.ai Enhanced kerül kiadásra MIT, egy engedékeny nyílt forráskódú licenc. Önálló STT.ai Enhanced saját hardveren, vagy használja a mi hosted verziónk mind kereskedelmileg használható.
STT.ai Enhanced támogatja a 99 nyelvet. Auto-detection kiválasztja a megfelelő nyelvet a legtöbb audio; akkor is megadhatja manuálisan egy kis pontosságú lift.
STT.ai Enhanced audiót készít körülbelül 15.9x valós idejű GPU-n. Egy 1 órás audio fájl 3 perc alatt fejeződik be; hosszabb fájlok sorba állnak, és e-mailben értesítik őket.
STT.ai Enhanced van 1.55B paraméterek. Nagyobb modellek általában pontosabb, de lassabb; STT.ai hosts STT.ai Enhanced a GPU, így a paraméterszám nem befolyásolja az ügyfél-oldal teljesítményét.
STT.ai Enhanced minden formátumot elfogad, STT.ai támogatja az MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI és mások. Kimeneti mint TXT, SRT, VTT, DOCX, JSON, vagy PDF.
Igen. A szónoki diarization STT.ai Enhanced-rel együtt fut minden egyes átirathoz ~ minden hangszórót felcímkéznek, és utána átnevezheted őket a szerkesztőbe.
Igen. STT.ai Enhanced fut magáninfrastruktúránkban az audió alapértelmezés szerint kerül feldolgozásra és törlésre. A Pro+ bővíti az ügyféloldali titkosítást, így a kulcs nélkül olvashatatlanok az átiratok, és a Private Cloud lehetővé teszi, hogy STT.ai Enhanced teljes egészében a saját VPC-dön saját gépe legyen.
Használja a összehasonlítani-stt eszköz futtatni STT.ai Enhanced ellen bármely más támogatott modell ugyanazon audio ★ látni fogja WER, szegmensszám, hangszóró címkék, és a konfidencia pontszámok oldalról oldalra. A STT.ai Enhanced vs Whisper Large V3 összehasonlítás a leggyakrabban fut.
Igen. A Python és a Node.js SDK-k STT.ai Enhanced példát tartalmaznak. A Free API-szint 100 percet/hónapot tartalmaz.
Igen. Mivel a STT.ai Enhanced MIT engedéllyel rendelkezik, saját maga is üzemeltetheti. STT.ai nyílt forráskódú oldala felsorolja a projekt repo- és súlyait. A legtöbb gyártócsapat a GPU beszerzések, modellswapok és op-ok kihagyására használja a hostált verziónkat.