Gratis AI Pidato ke Teks

Bimbing audio & video ke teks dalam 100+ bahasa. Model Berbisik multiple. Pendeteksian Speaker. Tidak diperlukan pendaftaran.

15.2K
transkripsi
382.6K
menit ditranskrip
100+
bahasa
59
perkakas bebas

Bekerja dengan audio & video yang tersedia di publik. Isi yang dilindungi DRM tidak didukung.

Tingkatkan untuk Diperbarui
Transkrip pribadi
Percakapan dengan transkrip
Buka Kunci dengan Pro →
Jatuhkan berkas di sini atau klik untuk diramban
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM sembari 2GB
Tingkatkan untuk Diperbarui
Transkrip pribadi
Percakapan dengan transkrip
Buka Kunci dengan Pro →
Tingkatkan untuk Diperbarui
Rekaman: 0:00
Real-time Vosk (instant)
Enhanced Berbisik (akurat)
Link publik: 24h, hanya teks · Daftar untuk audio 7d + · Pro untuk sambungan privat

Pidato real-time dengan teks. AI auto-treksis saat Anda berbicara dengan akurasi meningkatkan dengan pidato yang lebih panjang.

Uji mikrofon Anda terlebih dahulu
❤️ Katakan pada teman-temanmu!
Anda telah menggunakan transkripsi gratis Anda

Daftarlah gratis untuk mendapatkan 600 menit, atau upgrade dari $9/bulan untuk ribuan lebih.

10 menit/hari bebas 600 menit gratis dengan signup Tidak ada kartu kredit Terenkripsi
Bebas mendaftar →
Penyimpanan terenkripsi sisi klien — transkrip Anda dienkripsi di browser Anda Bahkan kita tidak bisa membacanya. Pelajari cara kerjanya →

Dipercaya oleh profesional di seluruh dunia

Cara Kerja STT.ai

Tiga langkah menuju transkripsi yang akurat

1. Upload, Record, atau Tempel URL

Seret dan jatuhkan berkas audio atau video apapun (MP3, WAV, MP4, dan 20+ format). Rekam dari mikrofon Anda secara real-time. Atau tempelkan link dari YouTube, Vimeo, Tiktok, dan 1.300 platforms+.

2. AI Menandatangani dengan Pilihan Model Anda

Pilih model Whisper yang pas: Enhanced (besar-v3, paling akurat), Turbo (cepat, baku), Menengah atau Kecil. Bahasa auto-detect dari 99 pilihan. Diarasi Speaker mengidentifikasi siapa yang mengatakan apa.

3. Ekspor, Berbagi, atau Integrate

Unduh sebagai TXT, SRT, VTT, DOCX, JSON, atau PDF. Share melalui link. Gunakan API kami untuk mengintegrasikan transkripsi ke dalam aplikasi Anda. Sempurna untuk subtitle, catatan pertemuan, podcast, dan lebih.

100+
Bahasa Didukung
59
Perkakas Bebas
1,300+
Platform Didukung
7
Ekspor Format

API Pengembang-Pertama

Integrate speech-to-text into your app in minutes. RESTful API with real-time WebSocket streaming.

EST + WebSocket — Berkas upload dan streaming real-time
Multiple model — Whisper Turbo, Besar V3, Sedang & Kecil
Diarisasi Speaker — Auto-detect yang mengatakan apa
Keluaran fleksibel — JSON, TXT, SRT, VTT dengan penanda waktu kata
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Siap untuk menuliskan?

Tidak ada kartu kredit, tidak ada pendaftaran. 600 menit untuk memulai rencana gratis.

Mulai Mentranskrip

Pertanyaan yang Sering Diajukan

bicara ke teks berjalan di peramban Anda: paste URL, upload file, atau rekam dari mic Anda. STT.ai mengambil model AI dan mengembalikan transkrip dalam waktu kurang dari 5 menit. Ekspor sebagai TXT, SRT, VTT, DOCX, JSON, atau PDF.

Yes — every visitor gets 600 free minutes/month on STT.ai, usable for bicara ke teks the same as any other workflow. Paid plans starting at $9/month unlock longer files, private transcripts, and priority queueing.

bicara ke teks berjalan pada model AI yang sama seperti sisa STT.ai ▪ model terbaik kita mencapai 95-97% akurasi pada pidato yang bersih (3-5% Word Errors Rates pada benchmarks). Tukar model pada lalat jika lulus pertama adalah di bawah target Anda.

bicara ke teks dapat menjalankan salah satu model Whisper STT.ai host STT.ai Enhanced (Whisper big-v3, paling akurat, pada rencana yang dibayar), Whisper Besar V3, Whisper Turbo (cepat), Whispering Medium dan Whisper Small.

Setiap transkrip ekspor sebagai SRT atau VTT в bekerja dengan YouTube, Vimeo, TikTok, VLC, dan setiap pemutar video utama. alat subtitles terbakar overlays mereka ke video sebagai hardsubs.

Diaraisasi pembicara secara otomatis menandai setiap suara (Speaker 1, Speaker 2,...) dan Anda dapat mengubah nama mereka dalam editor bawaan.

Kebanyakan bicara ke teks pekerjaan selesai dalam waktu kurang dari 5 menit. Berkas audio 1 jam biasanya selesai dalam 2-3 menit dengan model tercepat kita. Kecepatan tergantung pada model pilihan dan muatan GPU saat ini.

bicara ke teks menerima 20+ format ▪ MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, dan lebih. Keluaran ke TXT, SRT, VTT, DOCX, JSON, atau PDF.

Ya. file audio yang dikirim ke bicara ke teks diproses dan dihapus secara baku. pro rencana menambahkan enkripsi sisi klien ▪ bahkan jika database STT.ai dilanggar, transkrip anda tidak dapat dibaca tanpa kunci anda. Data tidak pernah digunakan untuk pelatihan model tanpa eksplisit opt-in.

STT.ai menawarkan API TERHEBAT dengan Python dan Node.js SDKs, ditambah server MCP untuk Claude dan Kursor ▪ semua dapat digunakan untuk alur kerja bicara ke teks. Tingkat API gratis mencakup 100 menit/bulan.

Ya. setiap transkrip dibuka di dalam editor yang dibangun dimana anda dapat memperbaiki kata, mengubah nama speaker, menyesuaikan penanda waktu, dan menambahkan catatan. Semua perubahan disimpan secara otomatis.

Setiap transkrip mendapat URL yang unik untuk dibagi. Ekspor ke DOCX atau PDF untuk email. Rencana pro menambahkan password-proteksi dan sambungan permanen å berguna untuk klien kerja.

STT.ai menangani 1.300 platforms+ termasuk YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast host, dan lebih. URL transkripsi bekerja dengan konten yang tersedia secara publik hanya DRM-protected sourcess tidak dapat ditranskripsi.