NVIDIA Parakeet

STT.ai draait dit model niet.. Deze pagina is referentie informatie over het. Schrijf je in met de modellen die we uitvoeren →
3.0%
WER
1
Talen
55.0x
Snelheid
CC-BY-4.0
Licentie

Info NVIDIA Parakeet

NVIDIA Parakeet TDT 1.1B is een state-of-the-art Engels ASR model met behulp van FastConformer architectuur met Token-and-Duration Transducer (TDT). Het bereikt bijna-menselijke nauwkeurigheid op standaard Engelse benchmarks en is zeer geoptimaliseerd voor NVIDIA GPU's.

Talen Ondersteund door NVIDIA Parakeet

Veelgestelde vragen

NVIDIA Parakeet is een spraak-tekst model door NVIDIA. STT.ai draait momenteel niet NVIDIA Parakeet. Deze pagina is referentie informatie over het model. Voor transcriptie op STT.ai, de model picker biedt de Whisper familie (Turbo, Large V3, Medium, Small).

Op standaard benchmarks bereikt NVIDIA Parakeet ongeveer 3.0% Word Error Rate. Real-world nauwkeurigheid is afhankelijk van audiokwaliteit, accent en taal; voor lawaaierige of geaccentueerde opnames, verwachten een paar procentpunten hoger WER.

NVIDIA Parakeet is niet beschikbaar op STT.ai. De eigen licentievoorwaarden zijn van toepassing op het uitvoeren van het zelf. STT.ai gratis tier dekt de Whisper modellen die we doen uitvoeren.600 minuten om te beginnen, dan een maandelijkse gratis up-up.

NVIDIA Parakeet wordt vrijgegeven onder CC-BY-4.0, een permissieve open-source licentie. U kunt zelf-host NVIDIA Parakeet op uw eigen hardware of gebruik maken van onze gehoste versie zijn beide commercieel bruikbaar.

NVIDIA Parakeet ondersteunt 1 talen. Autodetectie kiest de juiste taal voor de meeste audio; u kunt het ook handmatig specificeren voor een kleine nauwkeurigheid lift.

NVIDIA Parakeet verwerkt audio op ongeveer 55.0x real-time op onze GPU's. Een 1-uurs audiobestand eindigt in minder dan 1 minuten; langere files wachtrij en melding per e-mail wanneer gedaan.

NVIDIA Parakeet heeft 1.1B parameters. Grotere modellen hebben de neiging om nauwkeuriger maar langzamer te zijn; STT.ai hosts NVIDIA Parakeet op GPU zodat de parametertelling geen invloed heeft op de prestaties van uw client-side.

NVIDIA Parakeet accepteert elk formaat dat STT.ai ondersteunt. MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, en anderen. Output als TXT, SRT, VTT, DOCX, JSON, of PDF.

Ja. Speaker diarization loopt naast NVIDIA Parakeet voor elke transcriptie • elke speaker is gelabeld en je kunt ze hernoemen in de editor achteraf.

Ja. NVIDIA Parakeet wordt uitgevoerd in onze beheerde omgeving audio wordt verwerkt en verwijderd standaard en nooit gebruikt voor training zonder expliciete opt-in. Pro plannen toevoegen client-side encryptie voor transcripten in rust.

Gebruik de compare-stt tool om NVIDIA Parakeet uit te voeren tegen elk ander ondersteund model op dezelfde audio, zie je WER, segment count, speaker labels, en vertrouwen scoort side-by-side. De NVIDIA Parakeet vs Whisper Large V3 vergelijking is de meest voorkomende run.

Ja. Geef "nvidia-parakeet" op als de modelparameter op het /v1/transcribe eindpunt. Python en Node.js SDK's bevatten NVIDIA Parakeet voorbeelden. Gratis API tier bevat 100 minuten/maand.

Ja. Omdat NVIDIA Parakeet is CC-BY-4.0-licentie, kunt u zelf-hosten. STT.ai open-source pagina bevat de project repo en gewichten. De meeste productieteams gebruiken onze gehoste versie om GPU inkoop over te slaan, model swaps, en ops.