NVIDIA Parakeet

STT.ai این مدل را اجرا نمی‌کند - این صفحه اطلاعات مرجعی در مورد آن است. با مدل هايي که اجرا ميکنيم رونوشت کن →
3.0%
WER
1
زبانها
55.0x
سرعت
CC-BY-4.0
مجوز

در مورد NVIDIA Parakeet

این مدل از معماری FastConformer با تبدیل‌کننده توکن و مدت زمان (TDT) استفاده می‌کند و در مقایسه با استانداردهای انگلیسی دقت نزدیک به انسان را به دست می‌آورد و برای پردازنده‌های گرافیکی انویدیا بهینه شده‌است.

زبانهای پشتیبانی‌شده NVIDIA Parakeet

اطلاعات مدل
  • ارائه‌دهندهNVIDIA
  • معماری-
  • مجوزCC-BY-4.0
  • به روزرسانیMar 2026

پرسشهای متداول

NVIDIA Parakeet یک مدل گفتار به متن توسط NVIDIA است. STT.ai در حال حاضر NVIDIA Parakeet را اجرا نمی‌کند — این صفحه اطلاعات مرجع در مورد مدل است. برای رونویسی در STT.ai ، انتخاب‌کننده مدل خانواده Whisper (Turbo, Large V3, Medium, Small) را ارائه می‌دهد.

On standard benchmarks, NVIDIA Parakeet achieves around 3.0% Word Error Rate. Real-world accuracy depends on audio quality, accent, and language; for noisy or accented recordings, expect a few percentage points higher WER.

NVIDIA Parakeet در STT.ai در دسترس نیست. شرایط مجوز خود را برای اجرای خود تنظیم می‌کند. STT.ai سطح رایگان مدل Whisper را پوشش می‌دهد که ما اجرا می‌کنیم - 600 دقیقه برای شروع، سپس یک ماه رایگان اضافه کردن.

NVIDIA Parakeet تحت CC-BY-4.0 منتشر می‌شود، یک مجوز آزاد آزاد. شما می‌توانید خودتان NVIDIA Parakeet را در سخت‌افزار خود میزبانی کنید یا از نسخه میزبانی شده ما استفاده کنید - هر دو قابل استفاده تجاری هستند.

NVIDIA Parakeet از زبان‌های 1 پشتیبانی می‌کند. تشخیص خودکار زبان درست را برای بیشتر صداها انتخاب می‌کند؛ همچنین می‌توانید آن را برای یک بالا رفتن دقت کوچک دستی مشخص کنید.

NVIDIA Parakeet processes audio at about 55.0x real-time on our GPUs. A 1-hour audio file finishes in under 1 minutes; longer files queue and notify by email when done.

NVIDIA Parakeet has 1.1B parameters. Larger models tend to be more accurate but slower; STT.ai hosts NVIDIA Parakeet on GPU so the parameter count doesn't affect your client-side performance.

NVIDIA Parakeet هر فرمتی را که STT.ai پشتیبانی می‌کند را می‌پذیرد - MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI و دیگران.

بله. نوشتار شنونده در کنار NVIDIA Parakeet برای هر رونوشت اجرا می شود — هر شنونده برچسب گذاری شده و می توانید بعداً آنها را در ویرایشگر تغییر نام دهید.

بله. NVIDIA Parakeet در محیط مدیریت شده ما اجرا می‌شود - صدا به صورت پیشفرض پردازش و حذف می‌شود و هیچگاه برای آموزش بدون انتخاب صریح استفاده نمی‌شود. برنامه‌های Pro رمزگذاری سمت مشتری را برای رونوشت‌های در حال استراحت اضافه می‌کنند.

Use the compare-stt tool to run NVIDIA Parakeet against any other supported model on the same audio — you'll see WER, segment count, speaker labels, and confidence scores side-by-side. The NVIDIA Parakeet vs Whisper Large V3 comparison is the most commonly run.

بله. "nvidia-parakeet" را به عنوان پارامتر مدل در /v1/transcribe endpoint مشخص کنید. Python و Node.js SDK شامل نمونه‌های NVIDIA Parakeet هستند. سطح API رایگان شامل ۱۰۰ دقیقه در ماه است.

بله. چون NVIDIA Parakeet دارای مجوز CC-BY-4.0 است، شما می‌توانید آن را خودتان میزبانی کنید. صفحهٔ منبع باز STT.ai فهرستی از پروژه و وزن‌ها را ارائه می‌دهد. بیشتر تیم‌های تولید از نسخهٔ میزبانی شده ما برای فراموش کردن خرید GPU، مبادلات مدل و عملیات استفاده می‌کنند.
Made by @nadermx