Free Speech to Text Online
Umseta tal til tekst við AI-dregnum transkriptión. Senda upp ljóðfiler, taka upp frá mikrofonini, ella líma inn ein URL. 100+ tungumál, opnar modeller, 98%+ nøgdsemi.
1. Upload Speech Recording
Send eina ljóð- ella video-skrá, lim inn ein URL, ella tak upp talað frá mikrofonini.
2. AI Converts Speech to Text
Vel Whisper-modellin, sum passar til tín ljóð. Talarauppsøgn og tungumálauppsøgn eru við.
3. Export Your Transcript
Download in 6 formats. Share transcript links with audio playback.
Text to Speech Models
Vel tað AI-modellið, sum passar tínum tørvi - ella lat okkum velja tað besta.
Speech to Text in 100+ languages
Ert tú klárur at umseta tal til tekst?
Start Free →Ofta settir spurningar
Speech to text (ogso nevnt speech recognition ella ASR) konverterar talaða ljóð til skrivlig orð sjálvvirkandi. STT.ai koyrir upptøkuna tína gjøgnum ein AI model, sum lurtar eftir ljóðinum og útsetir redigeranligan tekst við tímastemplum og speaker labels — eingin skriving er neyðug.
Ein akustisk skipan kortleggur ljóðbølguna til fonem, so setur ein málskipan tey saman til tey mest sannlíknu orðini og greinamerkini. STT.ai ger hetta á GPU við Whisper familjuni (Large V3 og Turbo), so ein ein tíma upptøka er vanliga gjørd á 2-3 minuttir.
Ja. Hver vitjandi fær 600 fríar minuttir um mánaðin uttan at skráseta seg til tín fyrsta skrá. Betalt ætlan byrjar á $9/month og leggur longri skrár, privatar avskriftir og forgangsviðgerð.
On clean speech our best models reach 95-97% accuracy (a 3-5% Word Error Rate on benchmarks). Accuracy falls with background noise, heavy accents, crosstalk, or low-bitrate audio — using a decent microphone and a quiet room makes the biggest difference.
Ja. Tala inn í mikrofonina, og STT.ai streamar transkriptiónina beinleiðis við beinleiðis transkriptiónstólinum. Tú kanst eisini senda eina fullfíggjaða upptøku upp til batch transkriptión, um tú ikki hevur tørv á henni orð fyri orð, meðan tú talar.
STT.ai kennir 100+ tungumál og finnur sjálvvirkandi talað mál fyri flestu ljóð. Tú kanst eisini seta tungumálið manuelt fyri at fáa eina lítla nákvæmnisøking, og blandaðar tungumálsupptøkur verða handfarnar við at skifta miðskeiðis í klippi.
Ja. Høvuðsrøða merkir hvørja rødd (Høvund 1, Høvuðsrøða 2,...), og tú kanst endurnøvna tær í ritstjóranum. Hetta virkar á øllum støddum og á øllum tungumálum.
STT.ai tekur ímóti 20+ sniðum, harímillum MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, og AVI.
Speech to text transscribes WHAT was said into words; voice recognition (speaker identification) determines WHO said it. STT.ai does both — transcription plus speaker diarization — but the terms describe different tasks.
Ja. Lyd verður viðgjørt og slettað sum standard. Pro-planir leggja til klient-side-kryptering, so at útskriftirnar eru ólesandi uttan tín lykil, sjálvt til STT.ai, og títt data verður ongantíð brúkt til model-trening uttan úttrykkiliga atkvøðugreiðslu.
Ja. STT.ai hevur eitt REST API við Python og Node.js SDKs og ein MCP server fyri Claude og Cursor. Frítt API-lag fevnir um 100 minuttir/mánað, við sekund-rekning út yvir tað.
Ja. Allar útskriftir opnast í einum innbyggdum rithøvunda, har tú kanst rætta mislýst orð, endurnøvna talarar, stilla tímastimbrar og leggja til merkis. Redigeringar verða viðgjørdar á øllum útflutningssniðum.