Free Audio to Text Online
Umseta ljóð til tekst við AI-drevnari transkriptión. Senda upp ljóðfiler, taka upp frá mikrofonini, ella líma inn ein URL. 100+ tungumál, 10+ modeller, 98%+ nøgdsemi.
Upplating
Upload MP3, WAV, M4A, FLAC, OGG, or any audio format. Up to 2GB.
2. AI Processes Audio
Hann hevur skrivað fleiri bøkur um søguna um søguna um søguna um søguna um søguna um søguna um søguna.
3. Get Your Transcript
Vist, broytt, hoyrt ella deilt. Eksportera sum TXT, SRT, VTT, DOCX ella PDF.
Text to Speech
Vel tað AI-modellið, sum passar tínum tørvi - ella lat okkum velja tað besta.
Translate Audio in 100+ Languages
Ert tú klárur at umseta ljóð til tekst?
Start Free →Ofta settir spurningar
STT.ai returns editable text with timestamps and speaker labels — most files finish in under five minutes. Listi yvir STT.ai-greinar á Wikimedia Commons
MP3, WAV, M4A, FLAC, OGG, AAC, AMR, og 10+ fleiri eru øll stuðlað. Tú skalt ikki konvertera millum snið fyrst - upplasta tað, sum upptøkutólið ella appið framleiðir.
Lítið. Lossless snið sum WAV og FLAC bera bit-perfekta ljóð, so nákvæmnin er bert avmarkað av skipanini og hátalara kláran. Lossy snið (MP3, M4A) við 128 kbps ella hægri eru í veruleikanum líka góð; sera lágir bitrateir undir 64 kbps kunnu kosta nakrar punktir.
Ja. STT.ai fevnir um 600 fríar minuttir at byrja við uttan at skráseta teg til tína fyrstu skrá. Betalt ætlan byrjar á $5/mánað og leggur longri skrár, privatar avskriftir og forgangsviðgerð.
On clean audio our best models reach 95-97% accuracy (3-5% Word Error Rate). Background noise, overlapping speakers, and strong accents are the main factors that lower accuracy.
Ja. Fríir brúkarar kunnu skriva upp til ein tíma fyri hvørja skrá; gjaldandi brúkarar kunnu skriva upp til 8+ tímar, sum fevnir um fulltíðar podcasts, intervju og ljóðbøkur í einum einasta pass.
Ja. Speaker diarization labels each voice (Speaker 1, Speaker 2,...) and you can rename them in the editor — works on every supported audio format and model.
Export to TXT, DOCX, PDF, JSON, or SRT/VTT subtitles. JSON keeps machine-readable timestamps and speaker labels; DOCX and PDF are best for sharing and archiving.
Ja. 100+ tungumál við auto-upptøku, og eisini møguleikan at seta tungumálið handilsliga. Blandað-málslig ljóð verða viðgjørd við at skifta miðskeiðis í skránni, og tú kanst umseta úrslitið seinni.
Ja. Lyd verður viðgjørt og slettað sum standard, og Pro-planir leggja til klient-side kryptering, so at útskriftir eru ólesandi uttan tín lykil. Einginting verður brúkt til at læra uttan at tú útgreiniliga velur tað.
Ja. Lím inn ein link frá einum av 1300+ stuðlaðum miðlum — podcast-gestum, SoundCloud, YouTube, og fleiri — og STT.ai fær ljóðin beint. DRM-verndar keldur kunnu ikki umskrivast.
Ja. REST API tekur ímóti ljóðskrám beint, við Python og Node.js SDKs og einum fríum støði á 100 minuttir/mánað. Per-sekund fakturering er galdandi uttan fyri tað fría støðið.