Free AI Proslov k textu

Přepsat audio & video do textu ve 100+ jazycích. 10+ AI modely. Detekce reproduktorů. Není nutné se přihlásit.

9.2K
přepisy
233.2K
minuty přepisované
100+
jazyky
70+
nástroje zdarma

Pracuje s veřejně dostupným audio & video. DRM-chráněný obsah není podporován.

Upgrade pro vylepšené
Soukromý přepis
Chat s přepisem
Odemknout s Pro →
Drop soubor zde nebo klikněte na prohlížení
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM do 2GB
Upgrade pro vylepšené
Soukromý přepis
Chat s přepisem
Odemknout s Pro →
Upgrade pro vylepšené
Nahrávání: 0:00
V reálném čase Vosk (v okamžiku)
Rozšířené Šepot (přesný)
Veřejné odkazy: 24h, pouze text · Zaregistrovat se pro 7d + audio · Pro pro soukromé spoje

V reálném čase řeč k textu. AI auto-opravy, jak mluvíte, přesnost se zlepšuje s delší řečí.

Nejdřív si otestuj mikrofon.
❤️ Love STT.ai? Tell your friends!
Použil jsi své svobodné přepisy.

Zaregistrujte se zdarma získat 600 minut / měsíc, nebo upgrade pro neomezené přepisy.

10 volných min/den 600 min zdarma s přihlášením Žádná kreditní karta Zašifrováno
Zaregistrujte se zdarma →
Zašifrované úložiště na straně klienta — Vaše přepisy jsou zašifrované ve vašem prohlížeči. Naučte se, jak to funguje →

Jak STT.ai funguje

Tři kroky k přesnému přepisu

1. Upload, Record, nebo Vložit URL

Přetáhněte a spusťte jakýkoli audio nebo video soubor (MP3, WAV, MP4, a 20+ formáty). Záznam z mikrofonu v reálném čase. Nebo vložte odkaz z YouTube, Vimeo, TikTok, a 1 300+ platformy.

2. AI Transcribe with Your Choice of Model

Vyberte si z 10+ AI modelů včetně Whisper, NVIDIA Canary (přesnost # 1) a Moonshine. Automaticky detekujte jazyk ze 100+ možností. Diarizace reproduktorů identifikuje, kdo co řekl.

3. Exportovat, sdílet nebo integrovat

Stáhnout jako TXT, SRT, VTT, DOCX, JSON, nebo PDF. Sdílet přes odkaz. Pomocí našeho API integrovat transkripci do aplikace. Ideální pro titulky, seznamovací poznámky, podcasty a další.

100+
Podporované jazyky
70+
Volné nástroje
1,300+
Podporované platformy
7
Exportovat formáty

Vývojář-První API

Integrovat řeč-to-text do aplikace v minutách. RESTful API s real-time WebSocket streamování.

REST + WebSocket — Nahrávání souborů a streamování v reálném čase
Více modelů — Whisper, Canary, Enhanced & more
Diarizace reproduktorů — Automaticky detekovat, kdo řekl to, co
Flexibilní výstup — JSON, TXT, SRT, VTT se slovními časovými známkami
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Připraveni přepsat?

Nahrajte svůj první soubor zdarma. Žádná kreditní karta, žádné přihlášení. 600 minut za měsíc na bezplatném plánu.

Spustit přepisování

Často kladené otázky

speech to text runs in your browser: paste a URL, upload a file, or record from your mic. STT.ai picks the AI model and returns the transcript in under 5 minutes. Export as TXT, SRT, VTT, DOCX, JSON, or PDF.

Yes — every visitor gets 600 free minutes/month on STT.ai, usable for speech to text the same as any other workflow. Paid plans starting at $5/month unlock longer files, private transcripts, and priority queueing.

speech to text runs on the same AI models as the rest of STT.ai — our best models reach 95-97% accuracy on clean speech (3-5% Word Error Rate on benchmarks). Switch models on the fly if the first pass is below your target.

speech to text can run on any of STT.ai's 10+ models — STT.ai Enhanced (most accurate), Whisper Large V3 (99 languages), NVIDIA Canary (#1 WER on supported langs), Whisper Turbo (fast), Moonshine (lightweight), and more.

Yes. Every transcript exports as SRT or VTT — works with YouTube, Vimeo, TikTok, VLC, and every major video player. The burn-subtitles tool overlays them onto video as hardsubs.

Yes. Speaker diarization automatically labels each voice (Speaker 1, Speaker 2, ...) and you can rename them in the built-in editor. Works across all models and languages.

Most speech to text jobs finish in under 5 minutes. A 1-hour audio file typically completes in 2-3 minutes with our fastest models. Speed depends on chosen model and current GPU load.

speech to text accepts 20+ formats — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, and more. Output to TXT, SRT, VTT, DOCX, JSON, or PDF.

Yes. Audio files submitted to speech to text are processed and deleted by default. Pro plans add client-side encryption — even if STT.ai's database is breached, your transcripts are unreadable without your key. Data is never used for model training without explicit opt-in.

Yes. STT.ai offers a REST API with Python and Node.js SDKs, plus an MCP server for Claude and Cursor — all usable for speech to text workflows. Free API tier includes 100 minutes/month.

Yes. Every transcript opens in the built-in editor where you can correct words, rename speakers, adjust timestamps, and add notes. All changes save automatically.

Every transcript gets a unique shareable URL. Export to DOCX or PDF for email. Pro plans add password-protected and permanent links — useful for client work.

STT.ai handles 1,300+ platforms including YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, and more. URL transcription works with publicly-available content only — DRM-protected sources can't be transcribed.