Fritt AI Tal till text

Översättning av ljud och video till text på 100+ språk. Flera Whisper modeller. Högtalardetektering. Ingen registrering krävs.

12K
transkriptioner
290.2K
minuter transkriberade
100+
språk
70+
Fria verktyg

Fungerar med allmänt tillgängligt ljud och video. DRM-skyddat innehåll stöds inte.

Uppgradering för förbättrad
Privat utskrift
Chatta med utskrift
Lås upp med Pro →
Släpp fil här eller klicka för att bläddra
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM – upp till 2GB
Uppgradering för förbättrad
Privat utskrift
Chatta med utskrift
Lås upp med Pro →
Uppgradering för förbättrad
Inspelning: 0:00
Realtid Vosk (instant)
Förstärkt Viskar (korrekt)
Allmänna länkar: 24h, endast text · Registrera dig för 7d + ljud · För för privata förbindelser

Real-time tal till text. AI auto-korrigerar medan du talar — noggrannheten förbättras med längre tal.

Testa din mikrofon först
❤️ Love STT.ai? Tell your friends!
Du har använt dina gratis transkriptioner

Registrera dig gratis för att få 600 minuter, eller uppgradera från $ 5 / månad för tusentals fler.

10 gratis min/dag 600 min gratis med anmälan Inget kreditkort Krypterad
Registrera dig gratis →
Klientsidekrypterad lagring@ info: whatsthis — Dina utskrifter är krypterade i din webbläsare, inte ens vi kan läsa dem. Lär dig hur det fungerar →

Tillförlitlig av yrkesverksamma över hela världen

Hur STT.ai fungerar

Tre steg till korrekt transkription

1. Ladda upp, spela in eller klistra in webbadressen

Dra och släpp alla ljud- eller videofiler (MP3, WAV, MP4 och 20+ format). Spela in från din mikrofon i realtid. Eller klistra in en länk från YouTube, Vimeo, TikTok och 1.300+ plattformar.

2. AI transkriberar med ditt val av modell

Välj Whisper-modellen som passar: Förstärkt (stor-v3, mest exakt), Turbo (snabb, standard), Medium eller Small. Automatiskt upptäcka språk från 99 alternativ. Högtalardiarization identifierar vem som sa vad.

3. Exportera, dela eller integrera

Ladda ner som TXT, SRT, VTT, DOCX, JSON eller PDF. Dela via länk. Använd vårt API för att integrera transkription i din app. Perfekt för textning, mötesanteckningar, podcasts med mera.

100+
Språk som stöds
70+
Gratis verktyg
1,300+
Plattformar som stöds
7
Exportformat

Utvecklar-första API

Integrera tal-till-text i din app på några minuter. RESTful API med realtid WebSocket streaming.

REST + WebSocket — Filuppladdning och streaming i realtid
Flera modeller — Vissningsturbo, stor V3, medelstor och liten
Högtalardiarisering — Automatisk upptäckt vem sa vad
Flexibel utgång — JSON, TXT, SRT, VTT med ordkombinationer
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Är du redo att transkribera?

Ladda upp din första fil gratis. Inget kreditkort, ingen registrering. 600 minuter för att börja på den fria planen.

Börja skriva om@ info: whatsthis

Vanliga frågor

tal till text körs i din webbläsare: klistra in en URL, ladda upp en fil, eller spela in från din mikrofon. STT.ai väljer AI-modellen och returnerar utskriften på under 5 minuter. Exportera som TXT, SRT, VTT, DOCX, JSON eller PDF.

Ja — varje besökare får 600 gratisminuter att starta på STT.ai, användbar för tal till text samma som alla andra arbetsflöden. Betald planer börjar på $ 5 / månad låsa upp längre filer, privata utskrifter, och prioritet köa.

tal till text körs på samma AI-modeller som resten av STT.ai – våra bästa modeller når 95-97% noggrannhet vid rent tal (3-5% Word Felfrekvens på riktmärken). Slå på modeller i farten om det första passet är under ditt mål.

tal till text kan köras på någon av Whisper modeller STT.ai värdar - STT.ai Enhanced (Whisper stor-v3, mest korrekt, på betalda planer), Whisper stora V3, Whisper Turbo (snabb), Whisper Medium och Whisper Small.

Ja. Varje utskrift exporterar som SRT eller VTT — fungerar med YouTube, Vimeo, TikTok, VLC, och varje större videospelare. Bränn-subtitles verktyget överlagrar dem på video som hårdsubsubs.

Ja. Högtalardiarization märker automatiskt varje röst (talare 1, talare 2,...) och du kan byta namn på dem i den inbyggda editorn. Fungerar över alla modeller och språk.

De flesta tal till text jobb slutar på under 5 minuter. En 1-timmars ljudfil kompletterar normalt i 2-3 minuter med våra snabbaste modeller. Hastighet beror på vald modell och nuvarande GPU belastning.

tal till text accepterar 20+ format — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, och mer. Utmatning till TXT, SRT, VTT, DOCX, JSON, eller PDF.

Ja. Ljudfiler som skickas till tal till text behandlas och tas bort som standard. Pro-planer lägger till kryptering på klientsidan – även om STT.ai: s databas bryts, dina utskrifter är oläsbara utan din nyckel. Data används aldrig för modellutbildning utan uttryckligt opt-in.

Ja. STT.ai erbjuder ett REST API med Python och Node.js SDKs, plus en MCP-server för Claude och Cursor – alla användbara för tal till text arbetsflöden. Gratis API-nivå inkluderar 100 minuter/månad.

Ja. Varje utskrift öppnas i den inbyggda editorn där du kan korrigera ord, byta namn på högtalare, justera tidsstämpel och lägga till anteckningar. Alla ändringar sparas automatiskt.

Varje utskrift får en unik delad URL. Exportera till DOCX eller PDF för e-post. Pro planer lägga lösenordsskyddade och permanenta länkar — användbart för klientarbete.

STT.ai hanterar 1.300+ plattformar inklusive YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast värdar, med mera. URL transkription fungerar med offentligt tillgängligt innehåll bara – DRM-skyddade källor kan inte transkriberas.