Free Speech to Text Online

Shndërro fjalën në tekst me transkriptimin e mbështetur nga AI. Ngarko file audio, regjistro nga mikrofoni yt, ose ngjite një URL. Mbi 100 gjuhë, 10+ modele, saktësi 98%.

Punon me audio dhe video në dispozicion publikisht. Përmbajtja e mbrojtur me DRM nuk suportohet.

Përmirëso për të Përmirësuar
Transkriptim privat
Chat me transkriptim
Zhblloko me Pro →
Lëviz file këtu ose kliko për të shfletuar
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — deri në 2GB
Përmirëso për të Përmirësuar
Transkriptim privat
Chat me transkriptim
Zhblloko me Pro →
Përmirëso për të Përmirësuar
Inçizimi: 0:00
Koha reale Dylli (i menjëhershëm)
Përmirësuar Pëshpëritja (e saktë)
Lidhje publike: 24h, vetëm tekst · Regjistrohu për 7d + audio · Pro për lidhje private

Fjalë në tekst në kohë reale. AI auto-korrigjon ndërsa flet — saktësia përmirësohet me fjalë më të gjata.

Testo së pari mikrofonin tënd
❤️ Të pëlqen STT.ai?
Ke përdorur transkriptimet e tua falas.

Regjistrohu falas për të marrë 600 minuta, ose përmirëso nga 5 $ në muaj për mijëra më shumë.

10 minuta të lira në ditë 600 min pa pagesë me regjistrim Pa kartë krediti E kriptuar
Regjistrohu falas →

1. Ngarko regjistrimin e fjalimit

Ngarko një file audio apo video, ngjite një URL, ose regjistro një fjalim nga mikrofoni yt.

2. AI konverton fjalën në tekst

Zgjidh nga 10+ modele të AI. Zbulimi i folësit dhe gjuha e zbuluar automatikisht përfshihen.

3. Eksporto transkriptin tënd

Shkarko në 6 formate. Shpërnda lidhjet e transkriptimit me riprodhimin e audios.

Formatet e suportuara të hyrjes së fjalëve

Fjalë në tekst në më shumë se 100 gjuhë

Gati për të konvertuar fjalën në tekst?

Fillo i lirë →

Pyetje të shpeshta

Fjalë në tekst (e quajtur gjithashtu njohje e fjalës ose ASR) konverton automatikisht zërin e folur në fjalë të shkruara. STT.ai e drejton regjistrimin tuaj nëpërmjet një modeli AI që dëgjon zërin dhe nxjerr tekst të editueshme me shtyllat e kohës dhe etiketat e folësit - nuk kërkohet shkrimi.

Një model akustik e përshkruan formën e valës së tingullit në fonema, pastaj një model gjuhësor i bashkon ato në fjalët më të mundshme dhe pikëshkrimin. STT.ai e bën këtë në GPU me modele si Whisper Large V3 dhe NVIDIA Canary, kështu që një regjistrim një orësh zakonisht bëhet në 2-3 minuta.

Po, çdo vizitor merr 600 minuta falas për të filluar pa regjistrim të kërkuar për dosjen e parë. Planet e paguar fillojnë nga $5 në muaj dhe shtojnë dosje më të gjata, transkripta private dhe përpunim përparësie.

Në fjalimin e qartë, modelet tona më të mira arrijnë 95-97% saktësi (një 3-5% normë gabimi të fjalës në bazë të standarteve). Saktësia bie me zhurmë të sfondit, theksime të rënda, ndërveprimi, ose audio me bitrate të ulët - përdorimi i një mikrofoni të denjë dhe një dhome e qetë bën ndryshimin më të madh.

Po. Fol në mikrofon dhe STT.ai do të transmetojë transkriptimin drejtpërsëdrejti nëpërmjet mjetit të transkriptimit në kohë reale. Mund të ngarkosh gjithashtu një regjistrim të përfunduar për transkriptim të grupit nëse nuk të duhet fjalë për fjalë ndërsa flet.

STT.ai njeh më shumë se 100 gjuhë dhe zbulon automatikisht gjuhën e folur për shumicën e audios. Mund të vendosni gjithashtu gjuhën manualisht për një rritje të vogël të saktësisë, dhe regjistrimet e përzjera gjuhësore trajtohen duke ndërruar në mes të klipit.

Po. Diarization Speaker etiketon çdo zë (Speaker 1, Speaker 2,...) dhe mund t'i riemërtoni ata në editor. Kjo funksionon në çdo model dhe gjuhë të suportuar.

STT.ai pranon më shumë se 20 formate duke përfshirë MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM dhe AVI. Shto në TXT, SRT, VTT, DOCX, JSON ose PDF.

Fjalimi në tekst transkribon Çfarë është thënë në fjalë; njohja e zërit (identifikimi i folësit) përcakton KUS është thënë. STT.ai i bën të dyja — transkriptimin plus diarization e folësit — por termat përshkruajnë detyra të ndryshme.

Po. Audio është përpunuar dhe fshirë në mënyrë të prezgjedhur. Planet Pro shtojnë kriptim në anën e klientit kështu që transkriptat janë të pa lexueshme pa çelësin tuaj, edhe në STT.ai, dhe të dhënat tuaja nuk përdoren kurrë për trainimin e modelit pa opsionin e hapur.

Po. STT.ai ka një API REST me Python dhe Node.js SDKs plus një server MCP për Claude dhe Cursor. Niveli i lirë i API përfshin 100 minuta në muaj, me faturimin për sekond përtej kësaj.

Po. Çdo transkriptim hapet në një editor të ndërtuar ku mund të rregulloni fjalët e dëgjuara gabimisht, të riemërtoni folësit, të rregulloni shtyllat e kohës dhe të shtoni shënime. Ndryshimet qëndrojnë në çdo format eksporti.