Transkripcija STT.ai Enhanced
4.2%
WER
99
Jezici
15.9x
Brzina
MIT
Licenca
O meni STT.ai Enhanced
STT.ai Enhanced je naš najprecizniji i najbrži model govora u tekst. Izgrađen na vrhunskoj transformatorskoj arhitekturi sa vlasničkim optimizacijama, on isporučuje vodeću stopu grešaka riječi u industriji preko 100+ jezika. Idealno za produkcijsku transkripciju, realno vrijeme podnaslova i korporativne aplikacije.
Jezici podržani STT.ai Enhanced
✦ Otključaj poboljšani model
Dobijte pristup našem najpreciznijem modelu sa bilo kojim plaćenim planom - Whisper large-v3, 99 jezika i diarizacija govornika.
Pogledaj planove →Informacije o modelu
- ProviderOpenAI (hosted by STT.ai)
- Arhitektura-
- LicencaMIT
- AžuriranoAug 2026
Često postavljana pitanja
STT.ai je domaćin STT.ai Enhanced na našoj GPU infrastrukturi tako da ga možete koristiti bez da osigurate svoj vlastiti hardver — uploadati audio ili video i izabrati STT.ai Enhanced iz birača modela.
Na standardnim benchmarkima, STT.ai Enhanced postiže oko 4.2% stope greške riječi. realna tačnost zavisi od kvaliteta zvuka, naglaska i jezika; za bučne ili naglašene snimke, očekujte nekoliko postotnih bodova više WER.
STT.ai Enhanced je premium model - uključen sa bilo kojim plaćenim STT.ai planom počevši od $5/mjesečno. Nije dostupan na besplatnom nivou: besplatni i anonimni uploadovi umjesto toga koriste Whisper Turbo.
STT.ai Enhanced je objavljen pod MIT, dozvoljenom licencom otvorenog koda.Možete sami hostati STT.ai Enhanced na svom hardveru ili koristiti našu hosted verziju — obje su komercijalno upotrebljive.
STT.ai Enhanced podržava 99 jezika. Automatsko otkrivanje bira ispravan jezik za većinu audio; također ga možete ručno odrediti za malo povećanje tačnosti.
STT.ai Enhanced obrađuje audio na oko 15.9x real-time na našim GPU-ovima. 1-satna audio datoteka završava za manje od 3 minuta; dulje datoteke čekaju i obavještavaju e-mailom kada je završeno.
STT.ai Enhanced ima 1.55B parametra. Veći modeli imaju tendenciju da budu precizniji ali sporiji; STT.ai hosta STT.ai Enhanced na GPU tako da broj parametara ne utječe na performanse klijenta.
STT.ai Enhanced prihvaća svaki format koji podržava STT.ai — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI i drugi. izlaz kao TXT, SRT, VTT, DOCX, JSON, ili PDF.
Da. Diarizacija govornika radi zajedno sa STT.ai Enhanced za svaku transkripciju - svaki govornik je označen i možete ih preimenovati u editoru kasnije.
Da. STT.ai Enhanced radi u našoj privatnoj infrastrukturi - audio se obrađuje i briše po defaultu. Pro+ dodaje šifriranje na strani klijenta tako da su transkripti nečitljivi bez vašeg ključa, a Privatni oblak vam omogućava da sami hostujete STT.ai Enhanced u potpunosti u vašem vlastitom VPC-u.
Koristite compare-stt alat da pokrenete STT.ai Enhanced protiv bilo kojeg drugog podržanog modela na istom audio — vidjet ćete WER, broj segmenata, oznake zvučnika, i pouzdanost ocjena jedan pored drugog. STT.ai Enhanced vs Whisper Large V3 usporedba je najčešća.
Da. Navedite "stt-ai-enhanced" kao modelni parametar na /v1/transcribe krajnjoj tački. Python i Node.js SDK-ovi uključuju STT.ai Enhanced primjere. Besplatni API nivo uključuje 100 minuta/mjesečno.
Da. Budući da je STT.ai Enhanced licenciran za MIT, možete ga sami postaviti. Stranica otvorenog koda za STT.ai navodi projektni repozitorij i težine. Većina produkcijskih timova koristi našu verziju za preskakanje nabavke GPU-a, zamjene modela i operacija.