Ingyenes beszéd szöveg Online
Konvertálni beszéd szöveg AI-vezérelt átírás. Feltöltése audio fájlokat, rekordot a mikrofon, vagy beillesztése URL. 100+ nyelvek, 10+ modellek, 98%+ pontosság.
1. Feltöltés Beszédrögzítés
Töltsön fel egy audio vagy videofájlt, illesszen be egy URL-t, vagy rögzítse a mikrofonból a beszédét.
2. AI átalakítja beszéd szöveg
Válasszon a 10+ MI modellek közül. A hangszóró érzékelése és a nyelv automatikus detektálása.
3. Exportálja a Transcriptet
Letöltés 6 formátumban. Ossza meg átirat linkek audio lejátszás.
Beszéd a szövegmodellekhez
Válassza ki az AI modellt, amely megfelel az Ön igényeinek, vagy válasszuk ki a legjobbat.
Beszéd a szövegben 100+ Nyelvek
Készen állsz, hogy átváltsd a beszédet szövegre?
Ingyenes indítás →Gyakran ismételt kérdések
A szövegre (más néven beszédfelismerésre vagy ASR-re) automatikusan átváltja a beszélt audiót írásbeli szavakká. STT.ai futtatja a felvételt egy MI modellen keresztül, amely hallgatja az audió és kimenetek szerkeszthető szöveget időbélyegekkel és hangszóró címkékkel · nem szükséges gépelés.
Egy akusztikus modell a hanghullámot a telefonokhoz térképezi, majd egy nyelvi modell összeállítja azokat a legvalószínűbb szavakba és írásjelekbe. STT.ai teszi ezt a GPU-n olyan modellekkel, mint a Whisper Large V3 és az NVIDIA Canary, így általában 2-3 perc alatt egy órás felvétel készül.
Igen. Minden látogató 600 ingyenes percet kap, hogy az első fájlhoz regisztráció nélkül kezdjen. A fizetett tervek $5/hónapban kezdődnek, és hosszabb fájlokat, privát átiratokat és elsőbbségi feldolgozást adnak hozzá.
A tiszta beszéd a legjobb modelleink elérik a 95-97%-os pontosságot (a 3-5%-os Word Error Rate a referenciaértékek). Pontosság csökken háttérzaj, nehéz akcentusok, keresztbeszélgetés, vagy alacsony bitráta audio ~ egy tisztességes mikrofon és egy csendes szoba teszi a legnagyobb különbséget.
Igen. Beszélj a mikrofonodba, és STT.ai-en élőben közvetítik az átiratot az élő átírási eszközön keresztül. Feltölthetsz egy kész felvételt a köteg átírásához, ha nincs szükséged rá szóról szóra, miközben beszélsz.
STT.ai felismeri a 100+ nyelvek és auto-detects a beszélt nyelv a legtöbb audio. Ön is beállíthatja a nyelvet manuálisan egy kis pontosságú lift, és a vegyes nyelvű felvételek kezeli kapcsolásával közép-klip.
Igen. Hangszóró diarization címkék minden hang (beszélő 1, hangszóró 2,...) és átnevezheti őket a szerkesztő. Ez működik minden támogatott modell és nyelv.
STT.ai 20+ formátumot fogad el, köztük MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM és AVI. Kimenet TXT, SRT, VTT, DOCX, JSON vagy PDF-re.
Beszédet a szöveg átírja What was sayed into words; hangfelismerés (hangazonosítás) határozza meg a WHO mondta. STT.ai nem mind ~ átirat plusz hangszóró diarization ~ de a kifejezések leírja a különböző feladatokat.
Igen. Az audio feldolgozása és törlése alapértelmezés szerint. Pro tervek hozzáadása kliens-oldal titkosítás így átiratok olvashatatlan nélkül a kulcs, még STT.ai, és az adatok soha nem használják modell képzés kifejezett opt-in nélkül.
Igen. STT.ai van egy REST API Python és Node.js SDKs plusz egy MCP szerver Claude és Cursor. Az ingyenes API szint tartalmaz 100 perc/hónap, másodpercenkénti számlázás túl.
Igen. Minden átirat egy beépített szerkesztőben nyílik meg, ahol meg lehet javítani a félrehallott szavakat, átnevezni a hangszórókat, időbélyegeket módosítani és jegyzeteket hozzáadni. A szerkesztések minden exportformátumban megmaradnak.