Gratis tale til tekst online

Konverter tale til tekst med AI-drevet transskription. Upload lydfiler, optage fra din mikrofon, eller indsæt en URL. 100+ sprog, åbne modeller, 98%+ nøjagtighed.

Fungerer med offentligt tilgængelig lyd og video. DRM- beskyttet indhold understøttes ikke.

Opgradering til forbedret
Privat udskrift
Chat med udskrift
Lås op med Pro →
Slip fil her eller klik for at gennemse
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM ~ op til 2GB
Opgradering til forbedret
Privat udskrift
Chat med udskrift
Lås op med Pro →
Opgradering til forbedret
Registrering: 0:00
Realtid Vosk (øjeblikkelig)
Forbedret Hvisken (præcis)
Offentlige links: 24h, kun tekst · Tilmeld dig for 7d + lyd · Pro til private forbindelser

Real-time tale til tekst. AI auto-korrigerer som du taler nøjagtighed forbedrer med længere tale.

Test din mikrofon først
❤️ Love STT.ai? Fortæl dine venner!
Du har brugt dine gratis transskriptioner

Gratis tilmelding for at få 600 minutter, eller opgradering fra $9/måned for tusindvis mere.

10 gratis min/dag 600 min fri med tilmelding Intet kreditkort Krypteret
Tilmeld dig gratis →

1. Upload Taleoptagelse

Uploade en lyd- eller videofil, indsætte en URL, eller optage tale fra din mikrofon.

2. AI Konverterer tale til tekst

Vælg den Whisper model, der passer til din lyd. Højttaler afsløring og sprog auto-detect inkluderet.

3. Eksportér din transskript

Download i 6 formater. Del udskrift links med lydafspilning.

Understøttede taleindgangsformater

Tale til tekstmodeller

Vælg den AI-model, der passer til dine behov eller lad os vælge den bedste.

Klar til at konvertere tale til tekst?

Start fri →

Ofte stillede spørgsmål

Tale til tekst (også kaldet talegenkendelse eller ASR) konverterer talte lyd til skrevne ord automatisk. STT.ai kører din optagelse gennem en AI-model, der lytter til lyd og udgange redigerbare tekst med tidsstempler og højttaleretiketter • ingen skrive kræves.

En akustisk model kortlægger lydbølgeformen til telefoner, så samler en sprogmodel dem i de mest sandsynlige ord og tegnsætning. STT.ai gør dette på GPU med Whisper familien (Stor V3 og Turbo), så en en-timers optagelse er normalt gøres på 2-3 minutter.

Ja. Hver besøgende får 600 gratis minutter om måneden uden tilmelding kræves for din første fil. Betalte planer starter ved $ 9 måneder og tilføje længere filer, private udskrifter og prioriteret behandling.

På ren tale vores bedste modeller nå 95-97% nøjagtighed (en 3-5% Word Error Rate på benchmarks). Nøjagtighed falder med baggrundsstøj, tunge accenter, crosstalk, eller lav-bitrate lyd! ved hjælp af en anstændig mikrofon og et roligt rum gør den største forskel.

Ja. Tal ind i din mikrofon og STT.ai streams udskrift live via live-transcription værktøj. Du kan også uploade en færdig optagelse til batch transskription, hvis du ikke har brug for det ord-for-ord, når du taler.

STT.ai genkender 100+ sprog og auto-detekterer det talte sprog for de fleste lyd. Du kan også indstille sproget manuelt for en lille nøjagtighed elevator, og blandet-sprog optagelser håndteres ved at skifte midt-klip.

Ja. Speaker diarization etiketter hver stemme (Speaker 1, Speaker 2,...) og du kan omdøbe dem i editoren. Dette virker på tværs af hver understøttet model og sprog.

STT.ai accepterer 20 + formater, herunder MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, og AVI. Output til TXT, SRT, VTT, DOCX, JSON, eller PDF.

Tale til tekst transcribes HVAD blev sagt i ord; stemmegenkendelse (højttaler identifikation) bestemmer WHO sagde det. STT.ai gør både transskription plus højttaler diarization men udtrykkene beskriver forskellige opgaver.

Ja. Lyd behandles og slettes som standard. Pro planer tilføje klient-side kryptering, så udskrifter er ulæselige uden din nøgle, selv til STT.ai, og dine data bruges aldrig til modeltræning uden eksplicit opt-in.

Ja. STT.ai har en REST API med Python og Node.js SDKs plus en MCP-server til Claude og Cursor. Det gratis API-niveau inkluderer 100 minutter/måned, med per-sekund fakturering ud over det.

Ja. Hver udskrift åbner i en indbygget editor, hvor du kan rette forkert hørte ord, omdøbe højttalere, justere tidsstempler og tilføje noter. Edits fortsætter på tværs af hver eksport format.