Ingeskryf met Vosk

Werke met beskikbare oudio-video. DRM-beskermde inhoud word nie ondersteun nie.

Gradeer op vir Verbetering
Privaat transkripsie
Gesels met transkripsie
Ontsluit met pro →
Laat val lêer hier of kliek na blaai
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM 4A tot 2GB
Gradeer op vir Verbetering
Privaat transkripsie
Gesels met transkripsie
Ontsluit met pro →
Gradeer op vir Verbetering
Neem tans op: 0:00
@ info: whatsthis Vosk (instant)
Verbeterde Fluister (juiste)
Openbare skakels: 24h, teks slegs · Teken op vir 7d + oudio · Pro vir private skakels

Ware-tyd spraak vir teks. K- outo-korress wanneer jy praat ooit- akkuraatheid verbeter met langer spraak.

Toets eers jou mikrofoon
❤️ Love STT.ai? Tell your friends!
Jy het jou gratis transkripsie gebruik

Teken vir vryheid op om 600 minute te kry, of opgradering van $9/month vir nog duisende.

10 vry min/dag 600 min vry met opteken Geen kredietkaart nie Geënkripteer
Teken gratis op →
12.0%
WER
20
Tale
100.0x
Spoed
Apache 2.0
Lisensie

Aangaande Vosk

Vosk is 'n woorderkenning gereedskapk wat werk sonder' n internet verbinding. Dit ondersteun 20+ tale met kompak modelle wat kan loop op mobiele toestelle, Raspberry Pi en enige platform. Gebou op Kaldi en ipvormer argitektuur.
Model InligtingName
  • VerskafferAlpha Cephei
  • Argitektuur-
  • LisensieApache 2.0
  • OpgedateerCancel: Meeting NameMeetingMar 2026

Vrae wat dikwels gevra word

Vosk is 'n spraak-na-teksmodel met Alpha Cephei. STT.ai gashere van ons GPU-fu-U-fustrasie sodat jy dit kan gebruik sonder om jou eie hardeware te verskaf ooit klank of video op te laai en Vosk van die modelpikkel te kies.

Op standaard bankmerke bereik Vosk om 12.0% Woord Fout tempo. Real-world akkuraatheid hang af van klankgehalte, aksent en taal; vir lawaaierige of gefluurde opnames, verwag 'n paar persentasie punte hoër WER.

Vosk loop op STT.ai se vry vlak ooit ooit meer as 600 minute om te begin teen geen koste nie. Paid planne voeg langer per-lêer perke by, private transkripsies en prioriteit wagtoue.

Vosk word vrygestel onder Apache 2.0, 'n permissiewe open-onse lisensie. Jy kan self-host Vosk op jou eie hardeware of gebruik ons gegasheer weergawe 2 is kommersieel bruikbaar.

Vosk ondersteun 20 tale. Outo-speur die regte taal vir die meeste oudio; u kan dit ook self spesifiseer vir 'n klein akkuraatheid.

Vosk verwerk klank oor ongeveer 100.0x real-time op ons GPUs. 'n 1-hour klank lêer eindig onder 1 minute; langer lêers wag en inkennis stel deur e-pos wanneer dit gedoen word.

Vosk het 50M parameters. Groter modelle is geneig om akkurater maar stadiger te wees; STT.ai-gashere Vosk op GPU sodat die parametertelling nie jou kliënt-side-prestasie beïnvloed nie.

Vosk accepts every format STT.ai supports — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, and others. Output as TXT, SRT, VTT, DOCX, JSON, or PDF.

Ja, Speaker diarisering loop langs Vosk vir elke transkripsie ium ium word elke spreker gemerk en jy kan hulle na die volgende in die redigeerder hernoem.

Ja. Vosk loop in ons bestuurde omgewing Lazlo-oudio word verwerk en uitgevee deur verstek en nooit gebruik vir opleiding sonder eksplisiete opt-in nie. Pro planne voeg kliënt-side enkripsie vir transkripsies op res.

Gebruik die vergelyk-stel gereedskap om Vosk te laat loop teen enige ander ondersteunde model op dieselfde oudio DVD jy sal sien WER, segment tel, luidspreker etikette en vertroue punte kant- by-side. die Vosk vs Whift Groot V3 vergelyking is die algemeenste hardloop.

Ja. Spesifiseer "vosk" as die model parameter op die /v1/aanteken eindepunt. Python en Node.js SDKs sluit 8800 voorbeelde in. Vry 'nPI-vlak sluit 100 minute/month in.

Ja. Omdat Vosk Apache 2.0-licensed is, kan jy self-host dit. STT.ai se ope-bou-blad gee 'n lys van die projek repo en gewigte. Mees produksiespanne gebruik ons gemoÃ" weergawe om GPU-berigting, model ruilinge en eeps te laat vaar.