Gratis tale til tekst tilkoblet

Gjør tale om til tekst med AI- motor transkription. Last opp lydfiler, ta opp fra mikrofonen din eller lim inn en URL. 100+ språk, 10+ modeller, 98%+ nøyaktighet.

Arbeider med offentlig tilgjengelig lyd og video. DRM- beskyttet innhold er ikke støttet.

Oppgradering for forbedret
Privat utskrift
Chat med utskrift
Lås opp med Pro →
Slipp fil her eller trykk for å bla gjennom
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — opptil 2GB
Oppgradering for forbedret
Privat utskrift
Chat med utskrift
Lås opp med Pro →
Oppgradering for forbedret
Opptak: 0:00
Sanntid Vosk (intant)
Forbedret Visking (nøyaktig)
Offentlige lenker: 24h, bare tekst · Registrer deg i 7d + lyd · Pro til private lenker

Sanntidstale til tekst. AI korrigerer automatisk mens du snakker – nøyaktighet forbedres med lengre tale.

Test mikrofonen din først
❤️ Kjærlighet STT.ai?
Du har brukt dine frie utskrifter

Bli gratis og få 600 minutter, eller oppgrader fra $5/måned for tusener mer.

10 gratis min/dag 600 min fri med registrering Intet kredittkort Kryptert
Registrer deg gratis →

1. Last opp taleopptak

Last opp en lyd- eller video- fil, lim inn en URL eller ta opp tale fra mikrofonen din.

2. AI konverterer tale til tekst

Velg blant 10+ AI- modeller. Auto- oppdaging av høyttaler og automatisk oppdaging av språk er medregnet.

3. Eksporter transkriptet ditt

Last ned i 6 formater. Del utskriftslenker med lydavspilling.

Støttede innlesingsformater for tale

Store/ små bokstaver i tale til tekstbruk

Klar til å omforme tale til tekst?

Start ledig →

Ofte stilte spørsmål

Opplesning til tekst (også kalt talegjenkjenning eller ASR) konverterer snakket lyd til skriftlige ord automatisk. STT.ai kjører opptaket ditt gjennom en AI- modell som lytter til teksten som kan redigeres med tidsstempel og høyttaleretiketter – ikke nødvendig med skrivetilgang.

En akustisk modell kartlegger lydbølgeformen til telefoner, så setter en språkmodell sammen disse til de mest sannsynlige ordene og punktbruken. STT.ai gjør dette på GPU med modeller som Whisper Stor V3 og NVIDIA Canary, så en én- times opptak gjøres vanligvis på 2-3 minutter.

Ja. Alle besøkende får 600 minutter til å starte uten å bli meldt inn til den første fila di. Betalingsplaner starter på $ 5/ måned og legger til flere filer, private utskrifter og prioritetsbehandling.

I ren tale har våre beste modeller 95-97% nøyaktighet (en 3-5% ordfeilrate på referanseverdier). Nøyaktighet faller med bakgrunnsstøy, tung aksent, crosstalk eller lav bitrate lyd – ved hjelp av en anstendig mikrofon og et stille rom gjør den største forskjellen.

Yes. Speak into your microphone and STT.ai streams the transcript live via the live-transcription tool. You can also upload a finished recording for batch transcription if you don't need it word-by-word as you talk.

STT.ai gjenkjenner 100+ språk og oppdager automatisk det talte språket for de fleste lydene. Du kan også sette opp språket manuelt for en liten presisjonsheis, og opptak i blandet språk håndteres ved å bytte mellom- klipp.

Ja. Høytaler- arisering merker hver stemme (høyttaler 1, høyttaler 2,...) og du kan endre navn på dem i redigeringen. Dette virker på tvers av alle modeller og språk som støttes.

STT.ai aksepterer 20+ formater, herunder MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM og AVI. Utdata til TXT, SRT, VTT, DOCX, JSON eller PDF.

Tale til tekst transcribes HVA ble sagt inn ord; stemmegjenkjenning (høytaleridentifisering) avgjør WHO sa det. STT.ai gjør begge – transkription pluss høyttalerdiarisering – men begrepene beskriver forskjellige oppgaver.

Ja. Lyd behandles og slettes som standard. Pro- planer legger til kryptering på klientsiden slik at utskrifter er uleselige uten din nøkkel, til og med STT.ai, og dine data blir aldri brukt til modellopplæring uten uttrykkelig valg.

Ja. STT.ai har et REST API med Python og Node. js SDKs pluss en MCP- tjener for Claude og Cursor. Det frie API- nivået inkluderer 100 minutter/ måned, med fakturering per sekund utover det.

Ja. Hver utskrift åpnes i et innebygd redigeringsprogram der du kan rette opp feilaktige ord, endre navn på høyttalere, justere tidsstempel og legge til notater. Redigeringer holder seg over alle eksportformater.