Ingyenes beszéd szöveg Online
Konvertálja beszéd szöveg AI-vezérelt átírás. Feltöltése audio fájlokat, rekordot a mikrofon, vagy illessze be egy URL. 100+ nyelvek, nyitott modellek, 98%+ pontosság.
1. Feltöltés Beszédrögzítés
Töltsön fel egy audio vagy videofájlt, illesszen be egy URL-t, vagy rögzítse a mikrofonból a beszédét.
2. AI átalakítja beszéd szöveg
Válassza ki a Whisper modell, amely illik a hang. Hangszóró érzékelése és a nyelv automatikus detekt is.
3. Exportálja a Transcriptet
Letöltés 6 formátumban. Ossza meg átirat linkek audio lejátszás.
Beszéd a szövegmodellekhez
Válassza ki az AI modellt, amely megfelel az Ön igényeinek, vagy válasszuk ki a legjobbat.
Beszéd a szövegben 100+ Nyelvek
Készen állsz, hogy átváltsd a beszédet szövegre?
Ingyenes indítás →Gyakran ismételt kérdések
A szövegre (más néven beszédfelismerésre vagy ASR-re) automatikusan átváltja a beszélt audiót írásbeli szavakká. STT.ai futtatja a felvételt egy MI modellen keresztül, amely hallgatja az audió és kimenetek szerkeszthető szöveget időbélyegekkel és hangszóró címkékkel · nem szükséges gépelés.
Egy akusztikus modell a hanghullámot a telefonokhoz térképezi, majd egy nyelvi modell a legvalószínűbb szavakba és írásjelekbe állítja össze azokat. STT.ai ezt a GPU-n a Whisper családdal (Large V3 és Turbo), így általában 2-3 perc alatt egy órás felvétel készül.
Igen. Minden látogató 600 ingyenes percet kap havonta, regisztráció nélkül az első fájlhoz. A fizetett tervek $9/hónapban kezdődnek, és hosszabb fájlokat, privát átiratokat és elsőbbséget élveznek.
A tiszta beszéd a legjobb modelleink elérik a 95-97%-os pontosságot (a 3-5%-os Word Error Rate a referenciaértékek). Pontosság csökken háttérzaj, nehéz akcentusok, keresztbeszélgetés, vagy alacsony bitráta audio ~ egy tisztességes mikrofon és egy csendes szoba teszi a legnagyobb különbséget.
Igen. Beszélj a mikrofonodba, és STT.ai-en élőben közvetítik az átiratot az élő átírási eszközön keresztül. Feltölthetsz egy kész felvételt a köteg átírásához, ha nincs szükséged rá szóról szóra, miközben beszélsz.
STT.ai felismeri a 100+ nyelvek és auto-detects a beszélt nyelv a legtöbb audio. Ön is beállíthatja a nyelvet manuálisan egy kis pontosságú lift, és a vegyes nyelvű felvételek kezeli kapcsolásával közép-klip.
Igen. Hangszóró diarization címkék minden hang (beszélő 1, hangszóró 2,...) és átnevezheti őket a szerkesztő. Ez működik minden támogatott modell és nyelv.
STT.ai 20+ formátumot fogad el, köztük MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM és AVI. Kimenet TXT, SRT, VTT, DOCX, JSON vagy PDF-re.
Beszédet a szöveg átírja What was sayed into words; hangfelismerés (hangazonosítás) határozza meg a WHO mondta. STT.ai nem mind ~ átirat plusz hangszóró diarization ~ de a kifejezések leírja a különböző feladatokat.
Igen. Az audio feldolgozása és törlése alapértelmezés szerint. Pro tervek hozzáadása kliens-oldal titkosítás így átiratok olvashatatlan nélkül a kulcs, még STT.ai, és az adatok soha nem használják modell képzés kifejezett opt-in nélkül.
Igen. STT.ai van egy REST API Python és Node.js SDKs plusz egy MCP szerver Claude és Cursor. Az ingyenes API szint tartalmaz 100 perc/hónap, másodpercenkénti számlázás túl.
Igen. Minden átirat egy beépített szerkesztőben nyílik meg, ahol meg lehet javítani a félrehallott szavakat, átnevezni a hangszórókat, időbélyegeket módosítani és jegyzeteket hozzáadni. A szerkesztések minden exportformátumban megmaradnak.