STT.ai Enhanced
STT.ai runs this model on the paid tier. It is the model behind STT.ai Enhanced. Free transcription uses Whisper Large v3 Turbo, which is faster.
Lihat rencana →
·
Ditranskripsikan Gratis dengan Whisper Turbo →
4.2%
WER
99
Bahasa
15.9x
Kecepatan
MIT
Lisensi
Tentang STT.ai Enhanced
STT.ai Raced adalah model pidato dan teks tercepat kami. Dibangun pada arsitektur transformator mutakhir dengan optimasi proprietary, memberikan tingkat kesalahan memimpin industri dalam 100 bahasa. Ideal untuk transkripsi produksi, real-time penterjemahan, dan aplikasi perusahaan.
✦ Buka Kunci Model Diperbaiki
Dapatkan akses ke model kami yang paling akurat dengan rencana yang dibayar ▪ Berbisik besar-v3, 99 bahasa, dan diarasi speaker.
Tilik Rencana →Info Model
- OperatorOpenAI (hosted by STT.ai)
- Arsitektur-
- LisensiMIT
- DiperbaruiAug 2026
Pertanyaan yang Sering Diajukan
STT.ai Enhanced is a speech-to-text model by OpenAI (hosted by STT.ai). STT.ai runs it on our own GPU for accounts on a paid plan, and it is the model behind the STT.ai Enhanced tier. Free transcription uses Whisper Large v3 Turbo, the faster checkpoint of the same family.
Pada benchmark standar, STT.ai Enhanced mencapai sekitar 4.2% Word Error Rate. Keakuratan Real-world tergantung pada kualitas audio, aksen, dan bahasa; untuk rekaman bising atau aksen, mengharapkan beberapa poin persentase lebih tinggi WER.
STT.ai Enhanced adalah model premium thosecludes with any paid STT.ai plan starting at 9/month. It is not available on the free tier: free and anonymous uploads run Whisper Turbo gantinya.
STT.ai Enhanced dirilis di bawah MIT, lisensi sumber terbuka perresensi. Anda dapat mengenali STT.ai Enhanced sendiri dengan perangkat keras Anda atau menggunakan versi host kami keduanya dapat digunakan secara komersial.
STT.ai Enhanced mendukung bahasa 99. Auto-deteksi memilih bahasa yang tepat untuk kebanyakan audio; Anda juga dapat menentukan secara manual untuk angkat akurasi kecil.
STT.ai Enhanced memproses audio pada sekitar 15.9x real-time pada GPUs kami. Sebuah berkas audio 1-jam selesai di bawah menit 3; antrian berkas lebih panjang dan beritahu melalui email ketika dilakukan.
STT.ai Enhanced memiliki parameter 1.55B. Model yang lebih besar cenderung lebih akurat tetapi lebih lambat; STT.ai host STT.ai Enhanced pada GPU sehingga parameter tak mempengaruhi kinerja sisi klien Anda.
STT.ai Enhanced menerima setiap format yang didukung STT.ai ▪ MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, dan lainnya. Keluaran sebagai TXT, SRT, VTT, DOCX, JSON, atau PDF.
Dirasi Speaker berjalan bersama STT.ai Enhanced untuk setiap transkripsi setiap pembicara diberi label dan Anda dapat mengubah nama mereka di editor sesudahnya.
STT.ai Enhanced berjalan di infrastruktur pribadi kami audio diproses dan dihapus secara baku Pro+ menambahkan enkripsi sisi klien jadi transkrip tidak terbaca tanpa kunci Anda, dan Private Cloud memungkinkan Anda STT.ai Enhanced yang suka menyuruh diri sendiri sepenuhnya dalam VPC Anda sendiri.
Use the compare-stt tool to run STT.ai Enhanced against any other supported model on the same audio — you'll see WER, segment count, speaker labels, and confidence scores side-by-side. The STT.ai Enhanced vs Whisper Large V3 comparison is the most commonly run.
Ya, pada rencana yang dibayar. Nyatakan "stt-ai-enhanced" sebagai parameter model pada titik akhir /v1/trancrite. Kunci tanpa rencana aktif disajikan Whisper Besar v3 Turbo sebaliknya. Permintaan masih berhasil; hanya menjalankan model Gratis.
Yes. Because STT.ai Enhanced is MIT-licensed, you can self-host it. STT.ai's open-source page lists the project repo and weights. Most production teams use our hosted version to skip GPU procurement, model swaps, and ops.