Ingyenes MI Beszéd szövegre

Átírás audio & video szöveg 100+ nyelven. Több Whisper modellek. Hangszóró detektálás. Nincs szükség regisztrációra.

12K
átiratok
290.2K
átírt percek@ info: whatsthis
100+
Nyelvek
70+
szabad szerszámok

Működik nyilvánosan elérhető audio & video. DRM-védett tartalom nem támogatott.

Frissítés a továbbfejlesztett
Magánátirat
Csevegés átirattal
Kinyitni a Pro-val →
Drop fájl itt vagy kattintson a böngészésre
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM maximum 2GB
Több fájl feltöltése (lásd 4. 4 pont)
Frissítés a továbbfejlesztett
Magánátirat
Csevegés átirattal
Kinyitni a Pro-val →
Frissítés a továbbfejlesztett
Felvétel: 0:00
Valós idejű Vosk (instant)
Továbbfejlesztett@ info: whatsthis Suttogó (pontos)
Nyilvános linkek: 24h, csak szöveg · Regisztrálj! 7d + audio · Pro magánkapcsolatok esetében

Valós idejű beszéd szöveg. AI automatikus javítások, ahogy beszél A pontosság hosszabb beszéddel javul.

Először teszteld a mikrofonodat.
❤️ Love STT.ai? Tell your friends!
Használtad az ingyenes átirataidat.

Jelentkezzen ingyenes kap 600 perc, vagy frissülni $5 hónap több ezer további.

10 ingyenes min/nap 600 perc ingyenes regisztrációval Nincs hitelkártyája. Titkosított
Regisztrálj ingyen! →
Ügyfél-oldal titkosított tárolása — Az átirataid titkosítva vannak a böngésződben. Ismerd meg, hogyan működik. →

Hogyan működik a STT.ai?

Három lépés a pontos átírásig

1. URL feltöltése, rögzítése vagy beillesztése

Húzzon és ejtsen bármilyen audio vagy video fájlt (MP3, WAV, MP4, és 20+ formátumok). Rekord a mikrofonból valós időben. Vagy illesszen be egy linket a YouTube-ról, Vimeo-ról, TikTok-ról és 1300+ platformról.

2. AI Transscribes with Your Choice of Model

Válassza ki a Whisper modell illeszkedik: Enhanced (nagy-v3, a legpontosabb), Turbo (gyors, az alapértelmezett), közepes vagy kis. Automatikusan detektált nyelv 99 lehetőségek. Előadó diarization azonosítja, hogy ki mit mondott.

3. Exportálás, megosztás vagy integráció

Letöltés TXT, SRT, VTT, DOCX, JSON vagy PDF formában. Ossza meg linken keresztül. Használja az API-t, hogy integrálja az átiratot az alkalmazásba. Tökéletes feliratok, meeting jegyzetek, podcasts, és így tovább.

100+
Támogatott nyelvek
70+
Ingyenes eszközök
1,300+
Támogatott platformok
7
Formátumok exportálása

Fejlesztő-első API

Beépíteni beszéd-szöveg az alkalmazásba percek alatt. RESTful API valós idejű WebSocket streaming.

REST + WebSocket — Fájlfeltöltés és valós idejű streaming
Többféle modell — Suttogó Turbó, nagy V3, közepes és kicsi
Hangszóró-diarizáció — Automata detektálás, ki mit mondott?
Rugalmas kimenet — JSON, TXT, SRT, VTT word időbélyegzőkkel
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Átváltasz egy másik beszédről egy szöveges szolgáltatásra?

Készen állsz az átírásra?

Az első fájl feltöltése ingyenes. Nincs hitelkártya, nincs regisztráció. 600 perc az ingyenes terv indításához.

Átírás indítása@ info: whatsthis

Gyakran ismételt kérdések

szöveges beszéd fut a böngészőben: illessze be az URL-t, töltsön fel egy fájlt, vagy rögzítse a mikrofonjából. STT.ai kiválasztja az MI modellt és 5 perc alatt visszaadja az átiratot. Export TXT, SRT, VTT, DOCX, JSON vagy PDF formájában.

Yes — every visitor gets 600 free minutes/month on STT.ai, usable for szöveges beszéd the same as any other workflow. Paid plans starting at $5/month unlock longer files, private transcripts, and priority queueing.

szöveges beszéd ugyanazokkal a AI modellekkel fut, mint a többi STT.ai · legjobb modellünk eléri a 95-97%-os pontosságot tiszta beszéd esetén (3-5% Word Error Rate on Performance). Switch modellek a légyen, ha az első hágó alatt a cél.

szöveges beszéd futhat bármelyik Whisper modell STT.ai hosts · STT.ai Enhanced (Whisper large-v3, a legpontosabb, fizetett tervek), Whisper Large V3, Whisper Turbo (gyors), Whisper Medium és Whisper Small.

Igen. Minden SRT vagy VTT export átirata a YouTube, Vimeo, TikTok, VLC és minden nagy videólejátszó segítségével történik. Az írásszöveg-kezelő eszköz a videóra hardsubsként helyezi át őket.

Igen. A hangszóró diarization automatikusan felcímkézi az egyes hangokat (Speaker 1, Speaker 2,...), és átnevezheti őket a beépített szerkesztő. Működik minden modell és nyelv.

A legtöbb szöveges beszéd állás 5 perc alatt ér véget. Egy 1 órás audio fájl általában 2-3 perc alatt befejezi a leggyorsabb modellek. Sebesség függ a kiválasztott modell és a jelenlegi GPU terhelés.

szöveges beszéd elfogad 20+ formátumot • MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI és így tovább. Kimenet TXT, SRT, VTT, DOCX, JSON vagy PDF-re.

Igen. A szöveges beszéd-ra benyújtott hangfájlokat alapértelmezés szerint feldolgozzák és törlik. A Pro tervek hozzáadják a kliens-oldal titkosítást ~ még akkor is, ha STT.ai adatbázisát megszegik, a transzkripciók nem olvashatók kulcs nélkül. Az adatokat soha nem használjuk modellképzéshez kifejezett opt-in nélkül.

Igen. STT.ai kínál egy REST API Python és Node.js SDKs, valamint egy MCP szerver Claude és Cursor DUPLIC minden használható szöveges beszéd munkafolyamatok. Ingyenes API szint tartalmaz 100 perc/hó.

Igen. Minden átirat a beépített szerkesztőben nyílik meg, ahol a szavakat lehet kijavítani, átnevezni a hangszórókat, időbélyegeket módosítani és jegyzeteket hozzáadni. Minden módosítás automatikusan menthető.

Minden átirat kap egy egyedülálló megosztható URL. Export DOCX vagy PDF e-mail. Pro tervek hozzá jelszavas védelem és állandó linkek • hasznos az ügyfél munkáját.

STT.ai fogható 1,300+ platformon, beleértve a YouTube-ot, a Vimeo-t, a TikTok-ot, a SoundCloud-ot, a Zoom-ot, a Google Meet-et, a podcast-hostokat és még sok mást. URL-átírás csak nyilvánosan elérhető tartalmakkal működik · DRM-védett források nem írhatók le.