NVIDIA Parakeet
Ang STT.ai ay hindi tumatakbo sa modelong ito - ang pahina na ito ay reference na impormasyon tungkol dito.
Isulat sa mga modelo na namin patakbuhin →
3.0%
WER
1
Mga wika
55.0x
Bilis
CC-BY-4.0
Lisensya
Tungkol sa NVIDIA Parakeet
Ang NVIDIA Parakeet TDT 1.1B ay isang estado-ng-art na Ingles na modelo ng ASR na gumagamit ng arkitekturang FastConformer na may Token-and-Duration Transducer (TDT).
Mga wika na sinusuportahan ng NVIDIA Parakeet
Impormasyon ng Modelo
- TagapagbigayNVIDIA
- Arkitektura-
- LisensyaCC-BY-4.0
- Nai-updateMar 2026
Mga Madalas Itanong
Ang NVIDIA Parakeet ay isang modelong pagsasalita-sa-teksto ng NVIDIA. Ang STT.ai ay kasalukuyang hindi tumatakbo NVIDIA Parakeet — ang pahinang ito ay sanggunian ng impormasyon tungkol sa modelo. Para sa transkripsiyon sa STT.ai, ang modelong tagapili ay nag-aalok ng Whisper pamilya (Turbo, Large V3, Medium, Small).
Sa mga pamantayan benchmarks, NVIDIA Parakeet ay nakamit sa paligid ng 3.0% Word Error Rate. Real-world katumpakan ay depende sa kalidad ng audio, accent, at wika; para sa noisy o accented recordings, asahan ng ilang porsyento puntos mas mataas na WER.
Ang NVIDIA Parakeet ay hindi magagamit sa STT.ai. Ang sarili nitong mga tuntunin ng lisensya ay namamahala sa pagpapatakbo nito sa iyong sarili. Ang libreng antas ng STT.ai ay sumasaklaw sa mga modelo ng Whisper na aming pinapatakbo — 600 minuto upang magsimula, pagkatapos ay isang buwanang libreng top-up.
NVIDIA Parakeet ay inilabas sa ilalim ng CC-BY-4.0, isang permissive open-source na lisensya. Maaari mong self-host NVIDIA Parakeet sa iyong sariling hardware o gamitin ang aming hosted na bersyon - parehong commercially magagamit.
NVIDIA Parakeet sumusuporta sa 1 wika. Auto-detection picks ang tamang wika para sa karamihan ng audio; maaari mo ring tukuyin ito nang manu-mano para sa isang maliit na katumpakan lift.
NVIDIA Parakeet proseso audio sa tungkol sa 55.0x real-time sa aming GPUs. Ang isang 1-oras na audio file ay nagtatapos sa ilalim ng 1 minuto; mas mahabang file queue at mag-notify sa pamamagitan ng email kapag tapos na.
NVIDIA Parakeet ay may 1.1B parameter. Mas malaki modelo ay may posibilidad na maging mas tumpak ngunit mas mabagal; STT.ai host NVIDIA Parakeet sa GPU kaya ang bilang ng parameter ay hindi nakakaapekto sa iyong client-side pagganap.
Ang mga format na suportado ng STT.ai ay MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, at iba pa. Ang output ay TXT, SRT, VTT, DOCX, JSON, o PDF.
Oo. Speaker diarization tumatakbo kasama NVIDIA Parakeet para sa bawat transcription — bawat speaker ay may label at maaari mong palitan ang pangalan ng mga ito sa editor pagkatapos.
NVIDIA Parakeet tumatakbo sa aming pinamamahalaang kapaligiran – audio ay pinoproseso at tinanggal sa pamamagitan ng default at hindi kailanman ginagamit para sa pagsasanay nang walang malinaw na opt-in. Pro plano magdagdag ng client-side encryption para sa transcripts sa pahinga.
Gamitin ang i-compare-stt tool upang patakbuhin ang NVIDIA Parakeet laban sa anumang iba pang mga suportadong modelo sa parehong audio - makikita mo WER, segment count, speaker label, at kumpiyansa score side-by-side. Ang NVIDIA Parakeet vs Whisper Large V3 paghahambing ay ang pinaka-karaniwang tumakbo.
Oo. tukuyin ang "nvidia-parakeet" bilang ang modelo parameter sa / v1 / transcribe endpoint. Python at Node.js SDKs isama NVIDIA Parakeet halimbawa. Libreng API tier kasama ang 100 minuto / buwan.
Oo. Dahil NVIDIA Parakeet ay CC-BY-4.0-licensed, maaari mong self-host ito. STT.ai's open-source page listahan ng proyekto repo at timbang. Karamihan sa mga koponan ng produksyon gamitin ang aming hosted na bersyon upang i-skip GPU procurement, modelo swaps, at ops.