Gratis tale til tekst online

Konverter tale til tekst med AI-drevet transskription. Upload lydfiler, optage fra din mikrofon, eller indsætte en URL. 100+ sprog, 10+ modeller, 98%+ nøjagtighed.

Fungerer med offentligt tilgængelig lyd og video. DRM- beskyttet indhold understøttes ikke.

Opgradering til forbedret
Privat udskrift
Chat med udskrift
Lås op med Pro →
Slip fil her eller klik for at gennemse
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM ~ op til 2GB
Opgradering til forbedret
Privat udskrift
Chat med udskrift
Lås op med Pro →
Opgradering til forbedret
Registrering: 0:00
Realtid Vosk (øjeblikkelig)
Forbedret Hvisken (præcis)
Offentlige links: 24h, kun tekst · Tilmeld dig for 7d + lyd · Pro til private forbindelser

Real-time tale til tekst. AI auto-korrigerer som du taler nøjagtighed forbedrer med længere tale.

Test din mikrofon først
❤️ Love STT.ai? Fortæl dine venner!
Du har brugt dine gratis transskriptioner

Gratis tilmelding for at få 600 minutter, eller opgradering fra $5/måned for tusindvis mere.

10 gratis min/dag 600 min fri med tilmelding Intet kreditkort Krypteret
Tilmeld dig gratis →

1. Upload Taleoptagelse

Uploade en lyd- eller videofil, indsætte en URL, eller optage tale fra din mikrofon.

2. AI Konverterer tale til tekst

Vælg mellem 10+ AI-modeller. Højttalerdetektering og sprog auto-detect inkluderet.

3. Eksportér din transskript

Download i 6 formater. Del udskrift links med lydafspilning.

Understøttede taleindgangsformater

Klar til at konvertere tale til tekst?

Start fri →

Ofte stillede spørgsmål

Tale til tekst (også kaldet talegenkendelse eller ASR) konverterer talte lyd til skrevne ord automatisk. STT.ai kører din optagelse gennem en AI-model, der lytter til lyd og udgange redigerbare tekst med tidsstempler og højttaleretiketter • ingen skrive kræves.

En akustisk model kortlægger lydbølgeformen til telefoner, så samler en sprogmodel dem i de mest sandsynlige ord og tegnsætning. STT.ai gør dette på GPU med modeller som Whisper Large V3 og NVIDIA Canary, så en en-timers optagelse er normalt gøres på 2-3 minutter.

Ja. Hver besøgende får 600 gratis minutter til at starte med ingen tilmelding kræves til din første fil. Betalt planer starter på $5/måned og tilføje længere filer, private udskrifter, og prioriteret behandling.

På ren tale vores bedste modeller nå 95-97% nøjagtighed (en 3-5% Word Error Rate på benchmarks). Nøjagtighed falder med baggrundsstøj, tunge accenter, crosstalk, eller lav-bitrate lyd! ved hjælp af en anstændig mikrofon og et roligt rum gør den største forskel.

Ja. Tal ind i din mikrofon og STT.ai streams udskrift live via live-transcription værktøj. Du kan også uploade en færdig optagelse til batch transskription, hvis du ikke har brug for det ord-for-ord, når du taler.

STT.ai genkender 100+ sprog og auto-detekterer det talte sprog for de fleste lyd. Du kan også indstille sproget manuelt for en lille nøjagtighed elevator, og blandet-sprog optagelser håndteres ved at skifte midt-klip.

Ja. Speaker diarization etiketter hver stemme (Speaker 1, Speaker 2,...) og du kan omdøbe dem i editoren. Dette virker på tværs af hver understøttet model og sprog.

STT.ai accepterer 20 + formater, herunder MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, og AVI. Output til TXT, SRT, VTT, DOCX, JSON, eller PDF.

Tale til tekst transcribes HVAD blev sagt i ord; stemmegenkendelse (højttaler identifikation) bestemmer WHO sagde det. STT.ai gør både transskription plus højttaler diarization men udtrykkene beskriver forskellige opgaver.

Ja. Lyd behandles og slettes som standard. Pro planer tilføje klient-side kryptering, så udskrifter er ulæselige uden din nøgle, selv til STT.ai, og dine data bruges aldrig til modeltræning uden eksplicit opt-in.

Ja. STT.ai har en REST API med Python og Node.js SDKs plus en MCP-server til Claude og Cursor. Det gratis API-niveau inkluderer 100 minutter/måned, med per-sekund fakturering ud over det.

Ja. Hver udskrift åbner i en indbygget editor, hvor du kan rette forkert hørte ord, omdøbe højttalere, justere tidsstempler og tilføje noter. Edits fortsætter på tværs af hver eksport format.