Free AI Tale til tekst

Transkriber lyd og video til tekst på meir enn 100 språk. Fleire Whisper-modeller. Oppdag talarar. Ingen registrering krevst.

12.1K
transkripsjonar
292.7K
minutt transkribert
100+
språk
70+
ledig

Fungerer med offentleg tilgjengeleg lyd og video. DRM-verna innhald er ikkje støtta.

Oppgrader til utvida
Privat transkripsjon
Prate med transkripsjon
Lås opp med Pro →
Slepp fil her eller trykk for å bla
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — opptil 2 GB
Oppgrader til utvida
Privat transkripsjon
Prate med transkripsjon
Lås opp med Pro →
Oppgrader til utvida
Opptak: 0:00
Sanntids Voks (instant)
Forbetra Whisper (nøyaktig)
Offentlege lenkjer: 24h, berre tekst · Meld deg på for 7d + audio · Pro for private lenkjer

Tale til tekst i sanntid. AI korrigerer automatisk når du snakkar — nøyaktigheita aukar med lengre tale.

Test mikrofonen først
❤️ Elskar du STT.ai? Fortel vennene dine!
Du har brukt opp dei frie transkripsjonane dine

Registrer deg gratis for å få 600 minutt, eller oppgrader frå $5/månad for tusenvis av fleire.

10 ledig min/dag 600 min gratis ved påmelding Ingen kredittkort Kryptert
Meld deg på gratis →
Kryptert lagring på klientsida — Utskrifta di er kryptert i nettlesaren din. Ikkje engang vi kan lesa henne. Lær korleis det fungerer →

Korleis STT.ai fungerer

Tre steg til nøyaktig transkripsjon

1. Last opp, ta opp eller lim inn URL

Dra og slepp ei lyd- eller videofil (MP3, WAV, MP4 og 20+ format). Ta opp frå mikrofonen i sanntid. Eller lim inn ei lenkje frå YouTube, Vimeo, TikTok og 1300+ plattformar.

2. AI transkriberar med ditt val av modell

Vel den Whisper-modellen som passar deg best: Forbetra (large-v3, mest nøyaktig), Turbo (rask, standard), Medium eller Small. Auto-oppdag språk frå 99 val. Talediagrammet identifiserer kven som sa kva.

3. Eksporter, del eller integrer

Last ned som TXT, SRT, VTT, DOCX, JSON eller PDF. Del via lenkje. Bruk API-et vårt til å integrera transkripsjon i programmet ditt. Perfekt for underteksting, møtenotatar, podkastar og meir.

100+
Språk som er støtta
70+
Frie verktøy
1,300+
Støtta plattformar
7
Eksportformat

Utviklar-først API

Integrer tale-til-tekst i appen din på få minutt. RESTful API med sanntids WebSocket-strauming.

REST + WebSocket — Filopplasting og sanntidsstraum
Fleire modellar — Whisper Turbo, Large V3, Medium & Small
Høgtalardialog — Automatisk oppdag kven som sa kva
Fleksibel utdata — JSON, TXT, SRT, VTT med ordtidsstempel
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Klar til å transkribera?

Last opp den første fila di gratis. Ingen kredittkort, ingen registrering. 600 minutt for å starte på gratisplanen.

Start omskriving

Ofte stilte spørsmål

tale til tekst køyrer i nettlesaren din: lim inn ei nettadresse, last opp ei fil eller ta opp frå mikrofonen din. STT.ai vel AI-modellen og returnerer transkripsjonen på mindre enn 5 minutt. Eksporter som TXT, SRT, VTT, DOCX, JSON eller PDF.

Ja — kvar besøkjar får 600 gratis minutt til å starte på STT.ai, som kan brukast til tale til tekst på same måte som alle andre arbeidsflytar. Betalte planar frå $5/månad låser opp lengre filer, private transkripsjonar og prioritert kø.

tale til tekst køyrer på dei same AI-modellene som resten av STT.ai. Dei beste modellane våre har 95-97 % nøyaktigheit på klar tale (3-5 % feilrate på ord i referansetest). Byt modell på direkten dersom første passasje er under målet ditt.

tale til tekst kan køyra på alle Whisper-modellene STT.ai-vertar — STT.ai Enhanced (Whisper large-v3, mest nøyaktig, på betalte planar), Whisper Large V3, Whisper Turbo (rask), Whisper Medium og Whisper Small.

Ja. Kvar transkripsjon eksporterer som SRT eller VTT — fungerer med YouTube, Vimeo, TikTok, VLC og alle dei store videospelarane. Brenn-undertekst-verktøyet legg dei over på videoen som hardsubs.

Ja. Høgtalardialogar merker automatisk kvar stemme (Høgtalar 1, Høgtalar 2, & # 160; …), og du kan endra namnet på dei i det innebygde redigeringsprogrammet. Fungerer på alle modellar og språk.

Dei fleste tale til tekst jobbane er ferdige på mindre enn 5 minutt. Ein 1-timers lydfil er vanlegvis ferdig på 2-3 minutt med våre raskeste modellar. Farten avheng av den valde modellen og gjeldande grafikkprosessorbelastning.

tale til tekst støttar meir enn 20 format — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI og fleire. Utdata til TXT, SRT, VTT, DOCX, JSON eller PDF.

Ja. Lydfiler som vert sende til tale til tekst vert som standard handsama og sletta. Pro-planar legg til kryptering på klientsida - sjølv om databasen til STT.ai vert brutt, er avskrifta uleseleg utan nøkkelen din. Data vert aldri brukt til modelltrening utan eksplisitt samtykke.

Ja. STT.ai tilbyr eit REST API med Python og Node.js SDK-ar, i tillegg til ein MCP-tenar for Claude og Cursor — alt brukbart for tale til tekst arbeidsflytar. Gratis API-nivå inkluderer 100 minutt/månad.

Ja. Kvar avskrift vert opna i det innebygde redigeringsprogrammet der du kan korrigera ord, endra namn på elevar, justera tidsstempler og leggja til notatar. Alle endringar vert lagra automatisk.

Kvar transkripsjon får ein unik URL som kan delast. Eksporter til DOCX eller PDF for e-post. Pro-planar legg til passordbeskytta og permanente lenkjer - nyttig for klientarbeid.

STT.ai handterer meir enn 1300 plattformar, inkludert YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podkastvertar og meir. URL-transkripsjon fungerer berre med offentleg tilgjengeleg innhald - DRM-verna kjelder kan ikkje transkriberast.