Gratis tale til tekst online
Konverter tale til tekst med AI-drevet transskription. Upload lydfiler, optage fra din mikrofon, eller indsætte en URL. 100+ sprog, 10+ modeller, 98%+ nøjagtighed.
1. Upload Taleoptagelse
Uploade en lyd- eller videofil, indsætte en URL, eller optage tale fra din mikrofon.
2. AI Konverterer tale til tekst
Vælg mellem 10+ AI-modeller. Højttalerdetektering og sprog auto-detect inkluderet.
3. Eksportér din transskript
Download i 6 formater. Del udskrift links med lydafspilning.
Tale til tekstmodeller
Vælg den AI-model, der passer til dine behov eller lad os vælge den bedste.
Tale til tekst på 100+ sprog
Klar til at konvertere tale til tekst?
Start fri →Ofte stillede spørgsmål
Tale til tekst (også kaldet talegenkendelse eller ASR) konverterer talte lyd til skrevne ord automatisk. STT.ai kører din optagelse gennem en AI-model, der lytter til lyd og udgange redigerbare tekst med tidsstempler og højttaleretiketter • ingen skrive kræves.
En akustisk model kortlægger lydbølgeformen til telefoner, så samler en sprogmodel dem i de mest sandsynlige ord og tegnsætning. STT.ai gør dette på GPU med modeller som Whisper Large V3 og NVIDIA Canary, så en en-timers optagelse er normalt gøres på 2-3 minutter.
Ja. Hver besøgende får 600 gratis minutter til at starte med ingen tilmelding kræves til din første fil. Betalt planer starter på $5/måned og tilføje længere filer, private udskrifter, og prioriteret behandling.
På ren tale vores bedste modeller nå 95-97% nøjagtighed (en 3-5% Word Error Rate på benchmarks). Nøjagtighed falder med baggrundsstøj, tunge accenter, crosstalk, eller lav-bitrate lyd! ved hjælp af en anstændig mikrofon og et roligt rum gør den største forskel.
Ja. Tal ind i din mikrofon og STT.ai streams udskrift live via live-transcription værktøj. Du kan også uploade en færdig optagelse til batch transskription, hvis du ikke har brug for det ord-for-ord, når du taler.
STT.ai genkender 100+ sprog og auto-detekterer det talte sprog for de fleste lyd. Du kan også indstille sproget manuelt for en lille nøjagtighed elevator, og blandet-sprog optagelser håndteres ved at skifte midt-klip.
Ja. Speaker diarization etiketter hver stemme (Speaker 1, Speaker 2,...) og du kan omdøbe dem i editoren. Dette virker på tværs af hver understøttet model og sprog.
STT.ai accepterer 20 + formater, herunder MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, og AVI. Output til TXT, SRT, VTT, DOCX, JSON, eller PDF.
Tale til tekst transcribes HVAD blev sagt i ord; stemmegenkendelse (højttaler identifikation) bestemmer WHO sagde det. STT.ai gør både transskription plus højttaler diarization men udtrykkene beskriver forskellige opgaver.
Ja. Lyd behandles og slettes som standard. Pro planer tilføje klient-side kryptering, så udskrifter er ulæselige uden din nøgle, selv til STT.ai, og dine data bruges aldrig til modeltræning uden eksplicit opt-in.
Ja. STT.ai har en REST API med Python og Node.js SDKs plus en MCP-server til Claude og Cursor. Det gratis API-niveau inkluderer 100 minutter/måned, med per-sekund fakturering ud over det.
Ja. Hver udskrift åbner i en indbygget editor, hvor du kan rette forkert hørte ord, omdøbe højttalere, justere tidsstempler og tilføje noter. Edits fortsætter på tværs af hver eksport format.