Free AI Proslov k textu

Přepsat audio & video do textu ve 100+ jazycích. Více modelů šeptání. Detekce reproduktorů. Není nutné se přihlásit.

12K
přepisy
290.2K
minuty přepisované
100+
jazyky
70+
nástroje zdarma

Pracuje s veřejně dostupným audio & video. DRM-chráněný obsah není podporován.

Upgrade pro vylepšené
Soukromý přepis
Chat s přepisem
Odemknout s Pro →
Drop soubor zde nebo klikněte na prohlížení
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM do 2GB
Upgrade pro vylepšené
Soukromý přepis
Chat s přepisem
Odemknout s Pro →
Upgrade pro vylepšené
Nahrávání: 0:00
V reálném čase Vosk (v okamžiku)
Rozšířené Šepot (přesný)
Veřejné odkazy: 24h, pouze text · Zaregistrovat se pro 7d + audio · Pro pro soukromé spoje

V reálném čase řeč k textu. AI auto-opravy, jak mluvíte, přesnost se zlepšuje s delší řečí.

Nejdřív si otestuj mikrofon.
❤️ Love STT.ai? Tell your friends!
Použil jsi své svobodné přepisy.

Zaregistrujte se zdarma získat 600 minut, nebo upgrade z $ 5,měsíce za tisíce více.

10 volných min/den 600 min zdarma s přihlášením Žádná kreditní karta Zašifrováno
Zaregistrujte se zdarma →
Zašifrované úložiště na straně klienta — Vaše přepisy jsou zašifrované ve vašem prohlížeči. Naučte se, jak to funguje →

Jak STT.ai funguje

Tři kroky k přesnému přepisu

1. Upload, Record, nebo Vložit URL

Přetáhněte a spusťte jakýkoli audio nebo video soubor (MP3, WAV, MP4, a 20+ formáty). Záznam z mikrofonu v reálném čase. Nebo vložte odkaz z YouTube, Vimeo, TikTok, a 1 300+ platformy.

2. AI Transcribe with Your Choice of Model

Vyberte si model Whisper, který sedí: Rozšířená (velká-v3, nejpřesnější), Turbo (rychlá, výchozí), Střední nebo Small. Automaticky detekovat jazyk z 99 možností. Detekovat diarizaci reproduktor identifikuje, kdo řekl co.

3. Exportovat, sdílet nebo integrovat

Stáhnout jako TXT, SRT, VTT, DOCX, JSON, nebo PDF. Sdílet přes odkaz. Pomocí našeho API integrovat transkripci do aplikace. Ideální pro titulky, seznamovací poznámky, podcasty a další.

100+
Podporované jazyky
70+
Volné nástroje
1,300+
Podporované platformy
7
Exportovat formáty

Vývojář-První API

Integrovat řeč-to-text do aplikace v minutách. RESTful API s real-time WebSocket streamování.

REST + WebSocket — Nahrávání souborů a streamování v reálném čase
Více modelů — Whisper Turbo, velké V3, střední a malé
Diarizace reproduktorů — Automaticky detekovat, kdo řekl to, co
Flexibilní výstup — JSON, TXT, SRT, VTT se slovními časovými známkami
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Připraveni přepsat?

Nahrajte svůj první soubor zdarma. Žádná kreditní karta, žádné přihlášení. 600 minut začít na bezplatném plánu.

Spustit přepisování

Často kladené otázky

řeč k textu spustí ve vašem prohlížeči: vložte URL, nahrajte soubor nebo záznam z vašeho mikrofonu. STT.ai vybere model AI a vrátí přepis za méně než 5 minut. Exportujte jako TXT, SRT, VTT, DOCX, JSON nebo PDF.

Ano? Každý návštěvník dostane 600 volných minut začít na STT.ai, použitelné pro řeč k textu stejné jako ostatní pracovní postupy. Placené plány začínající na $5/měsíc odemknout delší soubory, soukromé přepisy, a prioritní fronty.

řeč k textu runs on the same AI models as the rest of STT.ai — our best models reach 95-97% accuracy on clean speech (3-5% Word Error Rate on benchmarks). Switch models on the fly if the first pass is below your target.

řeč k textu může běžet na kterémkoliv z modelů Whisper STT.ai hostitelů Ş STT.ai Enhanced (Šeptat velké-v3, nejpřesnější, na placené plány), Whisper Large V3, Whisper Turbo (rychlé), Whisper Medium a Whisper Small.

Ano. Každý transkripční export jako SRT nebo VTT? pracuje s YouTube, Vimeo, TikTok, VLC a každý hlavní video přehrávač. Spálené titulky nástroj překrývá je na video jako hardsubs.

Ano. Diarizace reproduktorů automaticky označuje každý hlas (Speaker 1, Speaker 2,...) a můžete jej přejmenovat ve vestavěném editoru. Pracuje ve všech modelech a jazycích.

Většina řeč k textu úloh končí za méně než 5 minut. 1 hodinový zvukový soubor obvykle za 2-3 minuty dokončí naše nejrychlejší modely. Rychlost závisí na zvoleném modelu a aktuálním zatížení GPU.

řeč k textu přijímá 20+ formátů ~ MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI a další. Výstup do TXT, SRT, VTT, DOCX, JSON, nebo PDF.

Ano. Audio soubory předložené do řeč k textu jsou zpracovány a smazány ve výchozím nastavení. Pro plány přidat klient-strana šifrování díry i když STT.ai databáze je porušena, vaše přepisy jsou nečitelné bez vašeho klíče. Data se nikdy nepoužívají pro model školení bez explicitního opt-in.

Ano. STT.ai nabízí REST API s Python a Node.js SDKs, plus MCP server pro Claude a Cursor?? vše použitelné pro řeč k textu pracovní postupy. Bezplatné API úroveň zahrnuje 100 minut / měsíc.

Ano. Každý přepis se otevře vestavěným editorem, kde můžete opravit slova, přejmenovat reproduktory, upravit časová razítka a přidat poznámky. Všechny změny se ukládají automaticky.

Každý přepis dostane jedinečnou sdílenou URL. Export do DOCX nebo PDF pro email. Pro plány přidat hesla chráněné a trvalé odkazy dírky užitečné pro klientskou práci.

STT.ai zvládá 1 300+ platformy včetně YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hostitele a další. Přepis URL funguje pouze s veřejně dostupným obsahem Ş DRM-chráněné zdroje nelze přepsat.