Zdarma proslov k textu online

Převést řeč na text pomocí AI transkripce. Nahrát zvukové soubory, záznam z mikrofonu, nebo vložit URL. 100+ jazyky, 10+ modely, 98%+ přesnost.

Pracuje s veřejně dostupným audio & video. DRM-chráněný obsah není podporován.

Upgrade pro vylepšené
Soukromý přepis
Chat s přepisem
Odemknout s Pro →
Drop soubor zde nebo klikněte na prohlížení
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM do 2GB
Upgrade pro vylepšené
Soukromý přepis
Chat s přepisem
Odemknout s Pro →
Upgrade pro vylepšené
Nahrávání: 0:00
V reálném čase Vosk (v okamžiku)
Rozšířené Šepot (přesný)
Veřejné odkazy: 24h, pouze text · Zaregistrovat se pro 7d + audio · Pro pro soukromé spoje

V reálném čase řeč k textu. AI auto-opravy, jak mluvíte, přesnost se zlepšuje s delší řečí.

Nejdřív si otestuj mikrofon.
❤️ Love STT.ai? Tell your friends!
Použil jsi své svobodné přepisy.

Zaregistrujte se zdarma získat 600 minut, nebo upgrade z $ 5,měsíce za tisíce více.

10 volných min/den 600 min zdarma s přihlášením Žádná kreditní karta Zašifrováno
Zaregistrujte se zdarma →

1. Odeslání nahrávání řeči

Nahrajte audio nebo video soubor, vložte URL, nebo záznam řeči z mikrofonu.

2. AI konvertuje řeč na text

Vyberte si z 10+ AI modelů. Detekce reproduktorů a jazyk auto-detekce zahrnuty.

3. Exportovat svůj Transcript

Stáhnout v 6 formátech. Sdílet transkripční odkazy s audio přehrávání.

Podporované formáty vstupů do řeči

Připraveni konvertovat řeč do textu?

Spustit zdarma →

Často kladené otázky

Proslov k textu (také nazývanému rozpoznávání řeči nebo ASR) automaticky přeměňuje mluvený zvuk na psaná slova. STT.ai spouští záznam pomocí modelu AI, který poslouchá audio a výstupy editovatelný text s časovými známkami a reproduktorové štítky?

Akustický model mapuje zvukovou vlnu do telefonů, pak jazykový model sestavuje ty do nejpravděpodobnějších slov a interpunkcí. STT.ai to dělá na GPU s modely jako Whisper Large V3 a NVIDIA Canary, takže jednohodinová nahrávka se obvykle provádí za 2-3 minuty.

Ano. Každý návštěvník dostane 600 minut zdarma začít bez nutnosti registrace pro váš první soubor. Placené plány začínají na $5/měsíc a přidat delší soubory, soukromé přepisy, a přednostní zpracování.

Na čisté řeči naše nejlepší modely dosáhnout 95-97% přesnosti (3-5% Word error Rate on benchmarks). Přesnost kapky s hlukem pozadí, těžké akcenty, crossttalk, nebo nízko-bitrátový zvuk za použití slušného mikrofonu a klidné místnosti dělá největší rozdíl.

Ano. Mluvte do mikrofonu a STT.ai streamů transcript živě pomocí nástroje Live-Transcription. Můžete také nahrát hotovou nahrávku pro transkripci šarží, pokud nepotřebujete slovo po slově, jak mluvíte.

STT.ai rozpozná 100+ jazyků a auto-detekuje mluvený jazyk pro většinu audio. Můžete také nastavit jazyk ručně pro malý výtah přesnosti, a smíšené-jazykové nahrávky jsou manipulovány přepínáním střední-klip.

Ano. Speaker diarization etikety každý hlas (Speaker 1, Speaker 2,...) a můžete je přejmenovat v editoru. To funguje napříč každým podporovaným modelem a jazykem.

STT.ai přijímá 20+ formátů včetně MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM a AVI. Výstup do TXT, SRT, VTT, DOCX, JSON, nebo PDF.

Řeč k textu přepisuje CO bylo řečeno ve slovech; rozpoznávání hlasu (identifikace reproduktoru) určuje WHO. STT.ai dělá jak transkripce a diarizace reproduktoru, ale termíny popisují různé úkoly.

Ano. Audio je zpracováno a smazáno ve výchozím nastavení. Pro plány přidat šifrování na straně klienta, takže přepisy jsou nečitelné bez vašeho klíče, dokonce i na STT.ai, a vaše data nejsou nikdy použita pro model školení bez explicitní opt-in.

Ano. STT.ai má REST API s Python a Node.js SDKs plus MCP server pro Claude a Cursor. Bezplatné API úroveň zahrnuje 100 minut / měsíc, s per-sekunda fakturace za to.

Ano. Každý přepis se otevře ve vestavěném editoru, kde můžete opravit špatně zasloužená slova, přejmenovat reproduktory, upravit časové značky a přidat poznámky. Editace přetrvávají v každém formátu exportu.