AI bebas Tutur ke Teks

Transkrip audio & video ke teks dalam 100+ bahasa. Model Whisper berbilang. Pengesanan pembicara. Tiada pendaftaran diperlukan.

12K
transkripsi
290.3K
minit ditranskripsikan
100+
bahasa
70+
alat bebas

Berfungsi dengan audio & video yang tersedia untuk umum. Kandungan yang dilindungi DRM tidak disokong.

Naik taraf untuk Dipertingkatkan
Transkripsi Peribadi
Berbual dengan transkripsi
Buka dengan Pro →
Letakkan fail di sini atau klik untuk layari
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — sehingga 2GB
Naik taraf untuk Dipertingkatkan
Transkripsi Peribadi
Berbual dengan transkripsi
Buka dengan Pro →
Naik taraf untuk Dipertingkatkan
Rekod: 0:00
Masa-nyata Lilin (sekejap)
Dipertingkatkan Whisper (accurate)
Pautan awam: 24h, teks sahaja · Daftar masuk untuk 7d + audio · Pro untuk pautan peribadi

Percakapan masa nyata ke teks. AI auto-betulkan bila anda bercakap — ketepatan bertambah dengan percakapan yang lebih panjang.

Uji mikrofon anda dahulu
❤️ Love STT.ai? Tell your friends!
Awak dah gunakan transkripsi percuma awak.

Daftar secara percuma untuk mendapatkan 600 minit, atau naik taraf dari $5/bulan untuk beribu-ribu lagi.

10 minit percuma/hari 600 min percuma dengan mendaftar Tiada kad kredit Disulitkan
Daftar masuk percuma →
Storan Disulitkan Sisi Klien — Transkrip awak disulitkan dalam pelayar awak, bahkan kami tidak boleh membacanya. Pelajari bagaimana ia berfungsi →

Dipercayai oleh profesional di seluruh dunia

Bagaimana STT.ai Berfungsi

Tiga langkah untuk transkripsi yang tepat

1. Muat naik, Rekod, atau Tampal URL

Seret dan lepaskan fail audio atau video (MP3, WAV, MP4, dan 20+ format). Rekod dari mikrofon anda dalam masa nyata. Atau tampal pautan dari YouTube, Vimeo, TikTok, dan 1,300+ platform.

2. AI mentranskripsikan dengan pilihan model anda

Pilih model Whisper yang sesuai: Dipertingkatkan (v3 besar, paling tepat), Turbo (cepat, default), Sederhana atau Kecil. Autokesan bahasa dari 99 pilihan. Diaris Speaker mengenal pasti siapa yang berkata apa.

3. Eksport, Kongsi, atau Integriti

Muat turun sebagai TXT, SRT, VTT, DOCX, JSON, atau PDF. Kongsi melalui pautan. Guna API kami untuk mengintegrasikan transkripsi ke dalam aplikasi anda. Sempurna untuk subtajuk, nota mesyuarat, podcast, dan lain-lain.

100+
Bahasa yang disokong
70+
Alat Bebas
1,300+
Platform yang disokong
7
Format Eksport

API Pemaju-Pertama

Integrikan percakapan-ke-teks ke dalam aplikasi anda dalam beberapa minit. API RESTful dengan strim WebSocket masa nyata.

REST + WebSocket — Memuat naik fail dan strim masa nyata
Berbilang model — Whisper Turbo, Besar V3, Sederhana & Kecil
Diarisasi Speaker — Auto-kesan siapa yang kata apa
Output fleksibel — JSON, TXT, SRT, VTT dengan setem masa perkataan
import requests

response = requests.post(
    "https://api.stt.ai/v1/transcribe",
    headers={"Authorization": f"Bearer {API_KEY}"},
    files={"file": open("meeting.mp3", "rb")},
    data={
        "model": "large-v3-turbo",
        "language": "auto",
        "diarize": "true",
        "response_format": "json",
    },
)

result = response.json()
for seg in result["segments"]:
    print(f"{seg['speaker']}: {seg['text']}")

Sedia untuk transkripsi?

Muat naik fail pertama anda secara percuma. Tiada kad kredit, tiada pendaftaran. 600 minit untuk mula pada rancangan percuma.

Mulakan Pentranskripsian

Soalan Lazim

ucapan ke teks berjalan dalam pelayar anda: tampal URL, muat naik fail, atau rakam dari mikrofon anda. STT.ai memilih model AI dan mengembalikan transkripsi dalam masa kurang dari 5 minit. Eksport sebagai TXT, SRT, VTT, DOCX, JSON, atau PDF.

Ya — setiap pengunjung mendapat 600 minit percuma untuk bermula pada STT.ai, boleh digunakan untuk ucapan ke teks sama seperti aliran kerja lain. Rancangan berbayar bermula pada $5/bulan membuka fail lebih panjang, transkripsi peribadi, dan baris gilir keutamaan.

ucapan ke teks berjalan pada model AI yang sama seperti yang lain dari STT.ai — model terbaik kami mencapai 95-97% ketelusan pada ucapan bersih (3-5% Kadar Ralat Perkataan pada benchmark). Tukar model semasa terbang jika laluan pertama di bawah sasaran anda.

ucapan ke teks boleh berjalan pada mana-mana model Whisper STT.ai hos — STT.ai Dipertingkatkan (Whisper besar-v3, paling tepat, pada rancangan berbayar), Whisper Besar V3, Whisper Turbo (cepat), Whisper Sederhana dan Whisper Kecil.

Ya. Setiap transkripsi mengeksport sebagai SRT atau VTT — berfungsi dengan YouTube, Vimeo, TikTok, VLC, dan setiap pemain video utama. Alat subtitel-bakar menutup mereka pada video sebagai hardsubs.

Ya. Diarisasi Speaker secara automatik melabel setiap suara (Speaker 1, Speaker 2,...) dan anda boleh menamakan semula mereka dalam editor terbenam. Berfungsi di semua model dan bahasa.

Kebanyakan ucapan ke teks kerja selesai dalam kurang daripada 5 minit. Fail audio 1 jam biasanya selesai dalam 2-3 minit dengan model terpantas kami. Kelajuan bergantung pada model dipilih dan beban GPU semasa.

ucapan ke teks menerima 20+ format — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, dan lain-lain. Output ke TXT, SRT, VTT, DOCX, JSON, atau PDF.

Ya. Fail audio yang dihantar ke ucapan ke teks diproses dan dipadam secara lalai. Pelan Pro menambah penyulitan sisi klien - walaupun pangkalan data STT.ai dilanggar, transkripsi anda tidak boleh dibaca tanpa kunci anda. Data tidak pernah digunakan untuk latihan model tanpa opt-in eksplisit.

Ya. STT.ai menawarkan API REST dengan Python dan Node.js SDK, ditambah pelayan MCP untuk Claude dan Cursor — semua boleh digunakan untuk ucapan ke teks aliran kerja. Tahap API percuma termasuk 100 minit/bulan.

Ya. Setiap transkripsi dibuka dalam editor terbenam di mana anda boleh betulkan perkataan, nama semula pembicara, selaraskan stamp masa, dan tambah nota. Semua perubahan disimpan secara automatik.

Setiap transkript mendapat URL yang boleh dikongsi unik. Eksport ke DOCX atau PDF untuk e-mel. Rancangan Pro menambah kata laluan yang dilindungi dan pautan kekal - berguna untuk kerja klien.

STT.ai mengendalikan 1,300+ platform termasuk YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, hos podcast, dan lebih. Pentranskripsian URL hanya berfungsi dengan kandungan yang boleh didapatkan secara awam — sumber yang dilindungi DRM tidak boleh ditranskripsikan.