Slobodna AI Pretvorba govora u tekst

Transkripcija audio i video zapisa u tekst na više od 100 jezika. Više modela Whisper-a. Otkrivanje govornika. Nema potrebe za registracijom.

12K
transkripcije
290.2K
minuta transkribirano
100+
Jezici
70+
slobodni alati

Radi sa javno dostupnim audio i video sadržajima. DRM-zaštićeni sadržaji nisu podržani.

Nadogradnja za poboljšano
Privatni transkript
Chat sa transkriptom
Otključaj sa Pro →
Ispusti datoteku ovdje ili klikni za pregledavanje
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — do 2GB
Nadogradnja za poboljšano
Privatni transkript
Chat sa transkriptom
Otključaj sa Pro →
Nadogradnja za poboljšano
Snimanje: 0:00
U stvarnom vremenu Vosak (trenutno)
Poboljšano Šepni (precizno)
2017.  Službena stranica (en) 24h. · Prijavite se for 7d + audio · Pro za privatne veze

Govor u tekst u realnom vremenu. AI automatski ispravlja dok govorite - tačnost se poboljšava s dužim govorom.

Prvo provjeri mikrofon
❤️ Volite STT.ai?
Koristio si svoje besplatne transkripte.

Prijavite se besplatno da biste dobili 600 minuta, ili nadogradite sa $5/mjesečno za hiljade više.

10 slobodnih minuta/dan 600 min besplatno uz prijavu Nema kreditne kartice Kriptirano
Prijavite se besplatno →
Klijentski šifrirani spremnik — Tvoj zapis je kriptiran u tvom pregledniku, čak ga ni mi ne možemo pročitati. Nauči kako to radi →

STT.ai.  Službena stranica

Tri koraka do tačnog prepisa

1. Upload, Record, or Paste URL

Povucite i ispustite bilo koju audio ili video datoteku (MP3, WAV, MP4, i 20+ formata). Snimite sa svog mikrofona u stvarnom vremenu. Ili zalijepite link sa YouTube, Vimeo, TikTok, i 1300+ platformi.

2. AI transkripira sa vašim izborom modela

Choose the Whisper model that fits: Enhanced (large-v3, most accurate), Turbo (fast, the default), Medium or Small. Auto-detect language from 99 options. Speaker diarization identifies who said what.

3. Izvoz, dijeljenje ili integracija

Preuzmite kao TXT, SRT, VTT, DOCX, JSON, ili PDF. Podijelite putem linka. Koristite naš API za integraciju transkripcije u vašu aplikaciju. Savršeno za podnaslove, bilješke sa sastanka, podcaste i drugo.

100+
Podržani jezici
70+
Slobodni alati
1,300+
Podržane platforme
7
Izvoz

Developer-First API

Integrirajte govor-u-tekst u svoju aplikaciju u minutama. RESTful API sa WebSocket streamingom u realnom vremenu.

REST + WebSocket — Učitavanje datoteka i strujanje u stvarnom vremenu
Više modela — Whisper Turbo, Large V3, Medium & Small
Dijagnoza — Automatski detektuje ko je šta rekao
Fleksibilan izlaz — JSON, TXT, SRT, VTT sa slovnim vremenskim žigom
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Spreman za transkripciju?

Učitaj svoj prvi dokument besplatno, bez kreditne kartice, bez registracije, 600 minuta za početak besplatnog plana.

Počni prepisivanje

Često postavljana pitanja

govor u tekst radi u vašem pregledniku: zalijepite URL, učitajte datoteku, ili snimite sa vašeg mikrofona. STT.ai izabire AI model i vraća transkript za manje od 5 minuta. Izvoz kao TXT, SRT, VTT, DOCX, JSON, ili PDF.

Da — svaki posjetilac dobiva 600 besplatnih minuta za početak na STT.ai, korisno za govor u tekst isto kao i bilo koji drugi radni tok. Plaćeni planovi počevši od $5/mjesečno otključavaju dulje datoteke, privatne transkripte i prioritetno redoslijed.

govor u tekst radi na istim AI modelima kao i ostali STT.ai — naši najbolji modeli postižu 95-97% preciznosti na čistom govoru (3-5% stopa grešaka u riječima na benchmarkima). Prebacivanje modela u pokretu ako je prvi prolaz ispod vašeg cilja.

govor u tekst can run on any of the Whisper models STT.ai hosts — STT.ai Enhanced (Whisper large-v3, most accurate, on paid plans), Whisper Large V3, Whisper Turbo (fast), Whisper Medium and Whisper Small.

Da. Svaki transkript se izvozi kao SRT ili VTT — radi sa YouTube, Vimeo, TikTok, VLC, i svim većim video playerima. Alat za snimanje titlova ih prekriva na video kao hardsubs.

Da. Dijariza zvučnika automatski označava svaki glas (Zvučnik 1, Zvučnik 2,...) i možete ih preimenovati u ugrađenom editoru. Radi na svim modelima i jezicima.

Većina govor u tekst zadataka završava za manje od 5 minuta. Jednosatna audio datoteka obično se završava za 2-3 minute na našim najbržim modelima. Brzina zavisi od odabranog modela i trenutnog opterećenja GPU-a.

govor u tekst prihvaća 20+ formata — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, i više. Izlaz u TXT, SRT, VTT, DOCX, JSON, ili PDF.

Da. Audio datoteke poslane na govor u tekst su obrađene i izbrisane po zadanim postavkama. Pro planovi dodaju šifriranje na strani klijenta - čak i ako je baza podataka STT.ai-a prekršena, vaši transkripti su nečitljivi bez vašeg ključa. Podaci se nikad ne koriste za trening modela bez eksplicitnog uključivanja.

Da. STT.ai nudi REST API sa Python i Node.js SDK-ovima, plus MCP server za Claude i Cursor — sve korisno za govor u tekst radne procese. Besplatni API nivo uključuje 100 minuta/mjesečno.

Da. Svaki transkript se otvara u ugrađenom editoru gdje možete ispraviti riječi, preimenovati govornike, podesiti vremenske oznake i dodati bilješke. Sve promjene se automatski spremaju.

Svaki transkript dobija jedinstveni URL koji se može dijeliti. Izvoz u DOCX ili PDF za e-mail. Pro planovi dodaju zaštićene lozinkom i trajne linkove - korisne za rad klijenta.

STT.ai upravlja 1.300+ platformi uključujući YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast domaćine, i više. URL transkripcija radi samo sa javno dostupnim sadržajem - DRM-zaštićeni izvori se ne mogu transkripirati.