Slobodna AL Govor prema tekstu

Transcribe audio & video za tekst na 100+ jezika. Višestruki Whisper modeli. Detekcija zvučnika. Nije potrebna prijava.

12K
transkripcije
290.2K
prepisane minute
100+
jezici
70+
besplatni alati

Radi s javno dostupnim audio & video. DRM zaštićeni sadržaj nije podržan.

Nadogradnja za poboljšanje
Privatni transkripti
Čavrljaj s transkriptom
Otključaj pomoću pro →
Ispustite datoteku ovdje ili kliknite za pregled
MP3, WAV, M4A, FLAC, MP4, MKV, pokret, WebM — do 2GB
Nadogradnja za poboljšanje
Privatni transkripti
Čavrljaj s transkriptom
Otključaj pomoću pro →
Nadogradnja za poboljšanje
Snimanje: 0:00
Realno vrijeme Vosk (instant)
Povećano Šaputanje (precizno)
Javne veze: 24h, samo tekst · Upišite se za 7d + zvuk · Profesionalno za privatne veze

Realno vrijeme govor na tekst. AI automatski ispravlja dok govorite – preciznost se poboljšava s dužim govorom.

Isprobaj prvo mikrofon
❤️ Love STT.ai? Tell your friends!
Koristio si besplatne transkripcije.

Prijavite se besplatno da biste dobili 600 minuta, ili nadogradnja od $5/mjesečno za tisuće više.

10 besplatnih min/dan 600 min besplatno s prijavom Nema kreditne kartice Šifrirano
Upišite se besplatno →
Šifrirano spremište na strani klijenta — Vaši transkripti su šifrirani u vašem pregledniku, čak i mi ih ne možemo pročitati. Naučite kako to funkcionira →

Kako STT.ai djeluje

Tri koraka do točne transkripcije

1. Pošaljite, snimite ili zalijepite URL

Povucite i ispustite bilo koju audio ili video datoteku (MP3, WAV, MP4, i 20+ formata). Snimite iz mikrofona u realnom vremenu. Ili zalijepite link iz YouTube, Vimeo, TikTok i 1.300+ platformi.

2. AI Tranpisteri s vašim izborom modela

Odaberite Whisper model koji odgovara: Povećana (velika-v3, najtočnije), Turbo (brzi, uobičajeni), Srednji ili Mali. Automatski prepoznati jezik iz 99 opcija. Zvučnička dijarizacija prepoznaje tko je rekao što.

3. Izvoz, dijeljenje ili integriranje

Preuzmite kao TXT, SRT, VTT, DOCX, JSON ili PDF. Podijelite putem linka. Koristite naš API za integraciju transkripcije u vašu aplikaciju. Savršeno za titlove, bilješke sastanka, podcasts, i više.

100+
Jezici podržani
70+
Slobodni alati
1,300+
Podržane platforme
7
Izvezi formate

Programer- prvi API

Integrirajte govor-na-tekst u svoju aplikaciju u minutama. RESTful API s real-time WebSocket streaming.

REST + WebSocket — Datoteka za slanje i streaming u realnom vremenu
Višestruki modeli — Šapuće Turbo, Veliki V3, Srednji i Mali
Dijarizacija zvučnika — Auto-otkrijte tko je rekao što
Flexibilan izlaz — JSON, TXT, SRT, VTT s vremenskim znakovima riječi
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Spremni za transkripciju?

Pošaljite vaš prvi dosje besplatno. Nema kreditne kartice, nema prijave. 600 minuta za početak na besplatnom planu.

Započni prepisivanje

Česta pitanja

govor na tekst pokreće u vašem pregledniku: umetnite URL, ubacite datoteku ili zapis iz vašeg mikrofona. STT.ai odabere AI model i vrati transkript u manje od 5 minuta. Izvezite kao TXT, SRT, VTT, DOCX, JSON ili PDF.

Da — svaki posjetitelj dobiva 600 besplatnih minuta za početak na STT.ai, upotrebljivo za govor na tekst isto kao i bilo koji drugi radni tok. Plaćeni planovi počevši od 5 dolara mjesečno otključavanje dužih datoteka, privatnih transkripta, i prioritet redoslijeda.

govor na tekst radi na istim AI modelima kao i ostatak STT.ai – naši najbolji modeli dostižu 95-97% preciznosti na čistom govoru (3-5% Word Pogreška na mjerila). Zamijenite modele na letu ako je prvi prolaz ispod vaše mete.

govor na tekst može pokrenuti na bilo koji od modela Whisper STT.ai domaćina — STT.ai Povećana (Whisper big-v3, najtočnije, na plaćenim planovima), Whisper Veliki V3, Whisper Turbo (brzo), Whisper Medium i Whisper Small.

Da. Svaki transkripti izvoz kao SRT ili VTT – radi s YouTube, Vimeo, TikTok, VLC, i svaki veliki video player. Alat gori-titles ih na video kao hardsubs.

Da. Dijarizacija zvučnika automatski označava svaki glas (Glasnik 1, Zvučnik 2,...) i možete ih preimenovati u ugrađenom uredniku. Radi na svim modelima i jezicima.

Većina govor na tekst zadaća završava za manje od 5 minuta. 1-satna audio datoteka obično završava u 2-3 minute s našim najbržim modelima. Brzina ovisi o odabranom modelu i trenutnom GPU opterećenju.

govor na tekst prihvaća 20+ formata — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOVI, WebM, AVI i više. Izlaz na TXT, SRT, VTT, DOCX, JSON ili PDF.

Da. Audio datoteke dostavljene u govor na tekst obrađuju se i brišu uobičajeno. Pro planovi dodaju enkripciju klijenta na strani strani - čak i ako je probijena STT.ai baza podataka, vaši transkripti su nepročitljivi bez ključa. Podaci se nikada ne koriste za model trening bez eksplicitne opt-in.

Da. STT.ai nudi REST API s Python i Node.js SDKs, plus MCP poslužitelj za Claude i Cursor — sve upotrebljivo za govor na tekst radni tokovi. Free API stupanj sadrži 100 minuta/mjesečno.

Da. Svaki transkript otvara u ugrađenom uređivaču gdje možete ispraviti riječi, preimenovati zvučnike, prilagoditi vremenske oznake i dodavati bilješke. Sve promjene uštede automatski.

Svaki transkript dobiva jedinstveni dijeljeni URL. Izvoz u DOCX ili PDF za e-mail. Pro planovi dodati zaštićene lozinke i stalne linkove — korisne za rad klijenta.

STT.ai upravlja 1.300+ platformama uključujući YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google susret, podcast domaćine i više. URL transkripcija radi samo s javno dostupnim sadržajem — DRM-zaštićeni izvori ne mogu biti transkriptirani.