Rapporteer bug / feature request

Transcriberen met Whisper Large V3

Name: Whisper Large V3
Author: OpenAI

Werkt met publiek beschikbare audio & video. DRM-beschermde inhoud wordt niet ondersteund.

Upgrade voor verbeterd

Privé-afschrift

Chat met transcript

Ontgrendelen met Pro →

Bestand hier neerzetten of klik om te bladeren

MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM tot 2GB

Batch meerdere bestanden uploaden met Pro

Upgrade voor verbeterd

Privé-afschrift

Chat met transcript

Ontgrendelen met Pro →

Upgrade voor verbeterd

Real-time spraak op tekst. AI auto-correcties als u spreekt.. de nauwkeurigheid verbetert met langere spraak.

Test eerst je microfoon

10 vrij min/dag 600 min vrij met aanmelding Geen creditcard Versleuteld

Gratis aanmelden →

4.2%

WER

Talen

8.0x

Snelheid

MIT

Licentie

Info Whisper Large V3

Whisper Large V3 is OpenAI's vlaggenschip open-source spraakherkenning model. Met 1,55 miljard parameters, het biedt uitzonderlijke nauwkeurigheid in 99 talen. Het maakt gebruik van een transformator encoder-decoder architectuur getraind op 680.000 uur meertalige audio data.

Talen Ondersteund door Whisper Large V3

Engels

Spaans

Frans

Duits

Chinees

Japans

Koreaans

Portugees

Arabisch

Hindi

Russisch

Italiaans

Nederlands

Turks

Pools

Zweeds

Indonesisch

Thai

Vietnamees

Tsjechisch

Grieks

Roemeens

Hongaars

Hebreeuws

Deens

Fins

Noors

Oekraïens

Maleis

Bengaals

Modelinformatie

AanbiederOpenAI
Architectuur-
LicentieMIT
BijgewerktMar 2026

Gerelateerde modellen

3.2% WER

5.1% WER

3.5% WER

7.8% WER

3.0% WER

Veelgestelde vragen

Whisper Large V3 is een speech-to-text model van OpenAI. STT.ai hosts Whisper Large V3 op onze GPU-infrastructuur, zodat u het kunt gebruiken zonder het voorzien van uw eigen hardware te uploaden audio of video en kies Whisper Large V3 uit de model picker.

Op standaard benchmarks bereikt Whisper Large V3 ongeveer 4.2% Word Error Rate. Real-world nauwkeurigheid is afhankelijk van audiokwaliteit, accent en taal; voor lawaaierige of geaccentueerde opnames, verwachten een paar procentpunten hoger WER.

Whisper Large V3 draait op STT.ai gratis tier.. elke bezoeker krijgt 600 minuten om te beginnen zonder kosten. Betaalde plannen toevoegen van langere per-bestand grenzen, privé transcripten, en prioriteit wachtrij.

Whisper Large V3 wordt vrijgegeven onder MIT, een permissieve open-source licentie. U kunt zelf-host Whisper Large V3 op uw eigen hardware of gebruik maken van onze gehoste versie zijn beide commercieel bruikbaar.

Whisper Large V3 ondersteunt 99 talen. Autodetectie kiest de juiste taal voor de meeste audio; u kunt het ook handmatig specificeren voor een kleine nauwkeurigheid lift.

Whisper Large V3 verwerkt audio op ongeveer 8.0x real-time op onze GPU's. Een 1-uurs audiobestand eindigt in minder dan 7 minuten; langere files wachtrij en melding per e-mail wanneer gedaan.

Whisper Large V3 heeft 1.55B parameters. Grotere modellen hebben de neiging om nauwkeuriger maar langzamer te zijn; STT.ai hosts Whisper Large V3 op GPU zodat de parametertelling geen invloed heeft op de prestaties van uw client-side.

Whisper Large V3 accepteert elk formaat dat STT.ai ondersteunt. MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, en anderen. Output als TXT, SRT, VTT, DOCX, JSON, of PDF.

Ja. Speaker diarization loopt naast Whisper Large V3 voor elke transcriptie • elke speaker is gelabeld en je kunt ze hernoemen in de editor achteraf.

Ja. Whisper Large V3 wordt uitgevoerd in onze beheerde omgeving audio wordt verwerkt en verwijderd standaard en nooit gebruikt voor training zonder expliciete opt-in. Pro plannen toevoegen client-side encryptie voor transcripten in rust.

Gebruik de compare-stt tool om Whisper Large V3 uit te voeren tegen elk ander ondersteund model op dezelfde audio, zie je WER, segment count, speaker labels, en vertrouwen scoort side-by-side. De Whisper Large V3 vs Whisper Large V3 vergelijking is de meest voorkomende run.

Ja. Geef "whisper-large-v3" op als de modelparameter op het /v1/transcribe eindpunt. Python en Node.js SDK's bevatten Whisper Large V3 voorbeelden. Gratis API tier bevat 100 minuten/maand.

Ja. Omdat Whisper Large V3 is MIT-licentie, kunt u zelf-hosten. STT.ai open-source pagina bevat de project repo en gewichten. De meeste productieteams gebruiken onze gehoste versie om GPU inkoop over te slaan, model swaps, en ops.

Transcriberen met Whisper Large V3

Info Whisper Large V3

Talen Ondersteund door Whisper Large V3

Modelinformatie

Gerelateerde modellen

Veelgestelde vragen

Wat is Whisper Large V3?

Hoe nauwkeurig is Whisper Large V3?

Is Whisper Large V3 gratis te gebruiken?

Welke licentie gebruikt Whisper Large V3?

Hoeveel talen ondersteunen Whisper Large V3?

Hoe snel is Whisper Large V3?

Hoe groot is het Whisper Large V3 model?

Welke audioformaten kunnen Whisper Large V3 transcriberen?

Detecteert Whisper Large V3 meerdere luidsprekers?

Zijn mijn gegevens privé wanneer ik Whisper Large V3 gebruik?

Hoe vergelijkt Whisper Large V3 met andere STT-modellen?

Kan ik Whisper Large V3 gebruiken via de API?

Kan ik Whisper Large V3 draaien op mijn eigen server?