NVIDIA Canary
STT.ai kò bá ṣẹ́gun àwọn ààyè yìí - ojú-ìwé yìí ní àwọn ìròyìn àwọn ìròyìn láti inú rẹ̀.
Ṣàfihàn àwọn àwọn ìṣàmúlò-ètò tí a tí n rọ́ọ̀nù →
3.5%
WER
4
Àwọn Àkọ́lé
45.0x
Ìjánú ìsàlẹ̀-ilà
CC-BY-4.0
Àwọn Àmì-ìwé
Ààyè-iṣẹ́ NVIDIA Canary
NVIDIA Canary ní móòdù àwọn ààtòjọ-ẹ̀yàn 1B tí o pọ̀ jú lọ nínú ìṣàfarawe-ẹ̀yàn Inúgíìsì, Jẹ́mánì, Fẹ́rẹ̀sì, àti Sẹ́faanì. Tí a kọ̀ nínú àwọn ààtòjọ-ẹ̀yàn NeMo, o ló àwọn ààtòjọ-ẹ̀yàn FastConformer láti mú àwọn ààtòjọ-ẹ̀yàn ìṣàfarawe-ẹ̀yàn yipadà ṣiṣẹ́, àtì ò ǹfàyé fún ìṣàfihàn àwọn ìtumọ̀ atí ìṣàfihàn ede.
Àwọn NVIDIA Canary
Àwọn Àlàyé Àwọn
- Àwọn Ìṣàmúlò-ètòNVIDIA
- Àwọn Ìṣàmúlò-ètò-
- Àwọn Àmì-ìwéCC-BY-4.0
- ÀkóónúMar 2026
Àwọn Àtòjọ-ẹ̀yàn
NVIDIA Canary ní móòdù ìtàn-si-àkọ́kọ́ láti NVIDIA. STT.ai kò bá NVIDIA Canary lọ́wọ́lọ́wọ́ - ojú-ìwé yìí ní àwọn ìròyìn àwọn ìròyìn láti inú móòdù yìí. Fún àkọ́kọ́ nípa STT.ai, àwọn àwọn ìṣàfihàn móòdù náà ǹfi ẹ̀yàn Whisper (Turbo, Large V3, Medium, Small) pamọ́.
On standard benchmarks, NVIDIA Canary achieves around 3.5% Word Error Rate. Real-world accuracy depends on audio quality, accent, and language; for noisy or accented recordings, expect a few percentage points higher WER.
NVIDIA Canary is not available on STT.ai. Its own licence terms govern running it yourself. STT.ai's free tier covers the Whisper models we do run — 600 minutes to start, then a monthly free top-up.
NVIDIA Canary tí a fi pamọ́ láti inú CC-BY-4.0, ìlàyè ìṣàfilọ́lẹ̀-ìṣílọ́lẹ̀. O lè fi NVIDIA Canary pamọ́ sípàrà rẹ̀ láti lò nínú àwọn ìṣàfilọ́lẹ̀ wà - gbogbo wọn ní a lè lò nínú iṣẹ́.
NVIDIA Canary ǹfà àwọn ìtàn 4. Àwọn ìṣàfihàn-ìdáràn àwọn ìtàn tí a fẹ́ fún àwọn ìṣàfihàn àwọn ìranlọwọ; o lè sọ̀rọ̀ nípa ìrànwọ́ fún ìṣàfihàn àwọn ìṣàfihàn àwọn ìṣàfihàn.
NVIDIA Canary ń ṣé ìṣàmúlò-ètò ìraǹdárà ní àwọn ìṣàmúlò-ètò 45.0x ní àwọn GPÙ wa. Fáìlì ìraǹdárà àwọn ààyè-ètò 1-àgójútó tí wọ́n tí ìjáde 1 àwọn ààyè-ètò; àwọn fáìlì tí o jú lọ ní àwọn ààyè-ètò àti àwọn ìṣàmúlò-ètò láti fi hàn látigbá tí a tí parí.
NVIDIA Canary ní àwọn ààtòjútó 1B. Àwọn àwọn ìṣàmúlò-ètò nlà ní ìṣàmúlò-ètò tí o darà jù lọ àwọn àwọn ààtòjútó tí o ní ìjánu-ìjánú; STT.ai ní àwọn ààtòjútó NVIDIA Canary lórí GPU láti jẹ́ pe àwọn ààtòjútó àwọn ààtòjútó kò bá ìṣẹ́dá ààtòjútó ààtòjútó rẹ̀ pẹ̀lú klíntì.
NVIDIA Canary gba gbogbo àwọn ìrísí-lẹ́tà tí STT.ai ǹfàyè — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, àti àwọn mìíràn. Àwọn ìṣàfilọ́lẹ̀ bí TXT, SRT, VTT, DOCX, JSON, tàbí PDF.
Ya. Ìṣàfilọ́lẹ̀ àwọn àkọlé àwọn àkọlé náà tí wọ́n lọ́wọ́lọ́wọ́ NVIDIA Canary fún ìṣàfilọ́lẹ̀ gbogbó - àwọn àkọlé àwòrán ní pàtó àwọn àkọlé àwòrán náà nínú àwọn àwọn àkọlé àwòrán.
Yes. NVIDIA Canary runs in our managed environment — audio is processed and deleted by default and never used for training without explicit opt-in. Pro plans add client-side encryption for transcripts at rest.
Use the compare-stt tool to run NVIDIA Canary against any other supported model on the same audio — you'll see WER, segment count, speaker labels, and confidence scores side-by-side. The NVIDIA Canary vs Whisper Large V3 comparison is the most commonly run.
Ya. Ṣàfihàn "nvidia-canary" bí àwọn ààtò ìṣàmúlò-ètò módè́èlì lórí àwọn ààtò ìparí iṣẹ́ /v1/transscribe. Python àti Node.js SDKs ní àwọn ààtò ìṣàmúlò-ètò NVIDIA Canary. Àwọn ààtò API àìfẹ́ ní àwọn ààtò 100 àwọn àkókò/óṣù.
Yes. Because NVIDIA Canary is CC-BY-4.0-licensed, you can self-host it. STT.ai's open-source page lists the project repo and weights. Most production teams use our hosted version to skip GPU procurement, model swaps, and ops.