Zdarma proslov k textu online
Převést řeč na text pomocí AI transkripce. Nahrát zvukové soubory, záznam z mikrofonu, nebo vložit URL. 100+ jazyky, 10+ modely, 98%+ přesnost.
1. Odeslání nahrávání řeči
Nahrajte audio nebo video soubor, vložte URL, nebo záznam řeči z mikrofonu.
2. AI konvertuje řeč na text
Vyberte si z 10+ AI modelů. Detekce reproduktorů a jazyk auto-detekce zahrnuty.
3. Exportovat svůj Transcript
Stáhnout v 6 formátech. Sdílet transkripční odkazy s audio přehrávání.
Proslov k textovým modelům
Vyberte si model AI, který vyhovuje vašim potřebám nebo si vyberte ten nejlepší.
Řeč k textu ve 100+ jazycích
Připraveni konvertovat řeč do textu?
Spustit zdarma →Často kladené otázky
Proslov k textu (také nazývanému rozpoznávání řeči nebo ASR) automaticky přeměňuje mluvený zvuk na psaná slova. STT.ai spouští záznam pomocí modelu AI, který poslouchá audio a výstupy editovatelný text s časovými známkami a reproduktorové štítky?
Akustický model mapuje zvukovou vlnu do telefonů, pak jazykový model sestavuje ty do nejpravděpodobnějších slov a interpunkcí. STT.ai to dělá na GPU s modely jako Whisper Large V3 a NVIDIA Canary, takže jednohodinová nahrávka se obvykle provádí za 2-3 minuty.
Ano. Každý návštěvník dostane 600 minut zdarma začít bez nutnosti registrace pro váš první soubor. Placené plány začínají na $5/měsíc a přidat delší soubory, soukromé přepisy, a přednostní zpracování.
Na čisté řeči naše nejlepší modely dosáhnout 95-97% přesnosti (3-5% Word error Rate on benchmarks). Přesnost kapky s hlukem pozadí, těžké akcenty, crossttalk, nebo nízko-bitrátový zvuk za použití slušného mikrofonu a klidné místnosti dělá největší rozdíl.
Ano. Mluvte do mikrofonu a STT.ai streamů transcript živě pomocí nástroje Live-Transcription. Můžete také nahrát hotovou nahrávku pro transkripci šarží, pokud nepotřebujete slovo po slově, jak mluvíte.
STT.ai rozpozná 100+ jazyků a auto-detekuje mluvený jazyk pro většinu audio. Můžete také nastavit jazyk ručně pro malý výtah přesnosti, a smíšené-jazykové nahrávky jsou manipulovány přepínáním střední-klip.
Ano. Speaker diarization etikety každý hlas (Speaker 1, Speaker 2,...) a můžete je přejmenovat v editoru. To funguje napříč každým podporovaným modelem a jazykem.
STT.ai přijímá 20+ formátů včetně MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM a AVI. Výstup do TXT, SRT, VTT, DOCX, JSON, nebo PDF.
Řeč k textu přepisuje CO bylo řečeno ve slovech; rozpoznávání hlasu (identifikace reproduktoru) určuje WHO. STT.ai dělá jak transkripce a diarizace reproduktoru, ale termíny popisují různé úkoly.
Ano. Audio je zpracováno a smazáno ve výchozím nastavení. Pro plány přidat šifrování na straně klienta, takže přepisy jsou nečitelné bez vašeho klíče, dokonce i na STT.ai, a vaše data nejsou nikdy použita pro model školení bez explicitní opt-in.
Ano. STT.ai má REST API s Python a Node.js SDKs plus MCP server pro Claude a Cursor. Bezplatné API úroveň zahrnuje 100 minut / měsíc, s per-sekunda fakturace za to.
Ano. Každý přepis se otevře ve vestavěném editoru, kde můžete opravit špatně zasloužená slova, přejmenovat reproduktory, upravit časové značky a přidat poznámky. Editace přetrvávají v každém formátu exportu.