Gratis ljud till text på nätet

Konvertera ljud till text med AI-driven transkription. Ladda upp ljudfiler, spela in från din mikrofon, eller klistra in en URL. 100+ språk, 10+ modeller, 98% + noggrannhet.

Fungerar med allmänt tillgängligt ljud och video. DRM-skyddat innehåll stöds inte.

Uppgradering för förbättrad
Privat utskrift
Chatta med utskrift
Lås upp med Pro →
Släpp fil här eller klicka för att bläddra
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM – upp till 2GB
Uppgradering för förbättrad
Privat utskrift
Chatta med utskrift
Lås upp med Pro →
Uppgradering för förbättrad
Inspelning: 0:00
Realtid Vosk (instant)
Förstärkt Viskar (korrekt)
Allmänna länkar: 24h, endast text · Registrera dig för 7d + ljud · För för privata förbindelser

Real-time tal till text. AI auto-korrigerar medan du talar — noggrannheten förbättras med längre tal.

Testa din mikrofon först
❤️ Love STT.ai? Tell your friends!
Du har använt dina gratis transkriptioner

Registrera dig gratis för att få 600 minuter, eller uppgradera från $ 5 / månad för tusentals fler.

10 gratis min/dag 600 min gratis med anmälan Inget kreditkort Krypterad
Registrera dig gratis →

1. Ladda upp ljud

Ladda upp MP3, WAV, M4A, FLAC, OGG, eller något ljudformat. Upp till 2 GB.

2. AI Processes Audio

AI extraherar tal från ditt ljud med högtalardetektering och tidsstämpelr.

3. Få din Transcript

Visa, redigera, ladda ner eller dela. Exportera som TXT, SRT, VTT, DOCX eller PDF.

Ljudformat som stöds

Redo att konvertera ljud till text?

Börja gratis →

Vanliga frågor

Ladda upp din ljudfil eller klistra in en URL, välj en AI-modell och klicka på Transcript. STT.ai returnerar redigerbar text med tidsstämpel och högtalaretiketter — de flesta filer slutar på under fem minuter.

MP3, WAV, M4A, FLAC, OGG, AAC, AMR och 10+ mer stöds. Du behöver inte konvertera mellan format först - ladda upp vad din inspelning eller app producerar.

Lite. Lossless format som WAV och FLAC bär bit-perfect ljud, så noggrannhet begränsas endast av modellen och högtalaren klarhet. Lossy format (MP3, M4A) på 128 kbps eller högre är effektivt identiska; mycket låga bitrates under 64 kbps kan kosta några poäng.

Ja. STT.ai inkluderar 600 gratis minuter att börja med ingen registrering för din första fil. Betald planer börjar på $ 5 / månad lägga till längre filer, privata utskrifter, och prioritetsbearbetning.

På rent ljud våra bästa modeller nå 95-97% noggrannhet (3-5% Word Felfrekvens). Bakgrund buller, överlappande högtalare och starka accenter är de viktigaste faktorerna som lägre noggrannhet.

Ja. Gratis användare kan transkribera upp till en timme per fil; betald planer förlänga det till 8+ timmar, som täcker full längd podcasts, intervjuer och ljudböcker i ett enda pass.

Ja. Högtalardiariseringsetiketter varje röst (talare 1, högtalare 2,...) och du kan byta namn på dem i editorn — fungerar på varje stödd ljudformat och modell.

Exportera till TXT, DOCX, PDF, JSON eller SRT/VTT textning. JSON håller maskinläsbara tidsstämplar och högtalaretiketter; DOCX och PDF är bäst för delning och arkivering.

Ja. 100+ språk med automatisk upptäckt, plus alternativet att ställa in språket manuellt. Blandat språk ljud hanteras genom att byta mitt-fil, och du kan översätta resultatet efteråt.

Ja. Ljud behandlas och tas bort som standard, och Pro planer lägga till klient-sida kryptering så utskrifter är oläsbara utan din nyckel. Ingenting används för utbildning utan uttryckligt opt-in.

Ja. Klistra in en länk från någon av 1.300+-stödda plattformar – podcast värdar, SoundCloud, YouTube, och mer – och STT.ai hämtar ljudet direkt. DRM-skyddade källor kan inte transkriberas.

Ja. REST API accepterar ljudfiler direkt, med Python och Node.js SDKs och en fri nivå på 100 minuter/månad. Per sekund fakturering gäller utanför den fria nivån.