NVIDIA Parakeet

STT.ai tidak menjalankan model ini. Halaman ini adalah informasi referensi tentang hal itu. Bimbing dengan model yang kita jalankan →
3.0%
WER
1
Bahasa
55.0x
Kecepatan
CC-BY-4.0
Lisensi

Tentang NVIDIA Parakeet

NVIDIA Parakeet TDT 1.1B adalah state-of-the-art model ASR Inggris menggunakan arsitektur FastConformer dengan Transducer Token-dan-Duducer (TDT). Ini mencapai akurasi hampir manusia pada benchmarks standar Inggris dan sangat teroptimasi untuk GPU NVIDIA.

Bahasa yang Didukung NVIDIA Parakeet

Pertanyaan yang Sering Diajukan

NVIDIA Parakeet adalah model pidato-to-teks oleh NVIDIA. STT.ai tidak saat ini menjalankan NVIDIA Parakeet ▪ Halaman ini adalah informasi referensi tentang model. Untuk transkripsi di STT.ai, model pemilih menawarkan keluarga Whisper (Turbo, Besar V3, Medium, Small).

Pada benchmark standar, NVIDIA Parakeet mencapai sekitar 3.0% Word Error Rate. Keakuratan Real-world tergantung pada kualitas audio, aksen, dan bahasa; untuk rekaman bising atau aksen, mengharapkan beberapa poin persentase lebih tinggi WER.

NVIDIA Parakeet tidak tersedia di STT.ai. dengan ketentuan lisensinya sendiri mengatur sendiri tingkat Gratis STT.ai mencakup model Whisper yang kita jalankan 600 menit untuk memulai, kemudian bulan Gratis.

NVIDIA Parakeet dirilis di bawah CC-BY-4.0, lisensi sumber terbuka perresensi. Anda dapat mengenali NVIDIA Parakeet sendiri dengan perangkat keras Anda atau menggunakan versi host kami keduanya dapat digunakan secara komersial.

NVIDIA Parakeet mendukung bahasa 1. Auto-deteksi memilih bahasa yang tepat untuk kebanyakan audio; Anda juga dapat menentukan secara manual untuk angkat akurasi kecil.

NVIDIA Parakeet memproses audio pada sekitar 55.0x real-time pada GPUs kami. Sebuah berkas audio 1-jam selesai di bawah menit 1; antrian berkas lebih panjang dan beritahu melalui email ketika dilakukan.

NVIDIA Parakeet memiliki parameter 1.1B. Model yang lebih besar cenderung lebih akurat tetapi lebih lambat; STT.ai host NVIDIA Parakeet pada GPU sehingga parameter tak mempengaruhi kinerja sisi klien Anda.

NVIDIA Parakeet menerima setiap format yang didukung STT.ai ▪ MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, dan lainnya. Keluaran sebagai TXT, SRT, VTT, DOCX, JSON, atau PDF.

Dirasi Speaker berjalan bersama NVIDIA Parakeet untuk setiap transkripsi setiap pembicara diberi label dan Anda dapat mengubah nama mereka di editor sesudahnya.

NVIDIA Parakeet berjalan di lingkungan yang dikelola kami audio diproses dan dihapus secara baku dan tidak pernah digunakan untuk pelatihan tanpa eksplisit opt-in. Pro rencana menambahkan klien-sisi enkripsi untuk transkrip di istirahat.

Use the compare-stt tool to run NVIDIA Parakeet against any other supported model on the same audio — you'll see WER, segment count, speaker labels, and confidence scores side-by-side. The NVIDIA Parakeet vs Whisper Large V3 comparison is the most commonly run.

Ya. Nyatakan "nvidia-parakeet" sebagai parameter model pada titik akhir /v1/trascrite. Python dan Node.js SDKs termasuk contoh NVIDIA Parakeet. Deret API gratis meliputi 100 menit/bulan.

Yes. Because NVIDIA Parakeet is CC-BY-4.0-licensed, you can self-host it. STT.ai's open-source page lists the project repo and weights. Most production teams use our hosted version to skip GPU procurement, model swaps, and ops.