Transcript âm thanh trong hơn 100 ngôn ngữ

Tải lên bất kỳ tập tin nào hoặc ghi âm trực tiếp. Tự động phát hiện ngôn ngữ.

Làm việc với âm thanh và video công cộng. Không hỗ trợ nội dung được bảo vệ DRM.

Tăng cấp cho nâng cấp
Bản dịch riêng
Trò chuyện với bản ghi chép
Mở khóa với Pro →
Thả tập tin vào đây hoặc nhấn để duyệt
MP3, WAV, M4A, FLAC, MP4, MKV, MOV, WebM — lên đến 2GB
Tăng cấp cho nâng cấp
Bản dịch riêng
Trò chuyện với bản ghi chép
Mở khóa với Pro →
Tăng cấp cho nâng cấp
Ghi âm: 0:00
Thời gian thực Sáp (trong giây lát)
Tăng cường Tiếng thì thầm (đúng)
Liên kết công cộng: 24h, chỉ văn bản · Đăng ký cho 7d + âm thanh · Tốt cho liên kết riêng

Tự động sửa lỗi khi bạn nói — độ chính xác tăng lên khi nói lâu hơn.

Kiểm tra micro đầu tiên
❤️ Cảm ơn bạn đã ghé thăm STT.ai.
Anh đã dùng bản dịch miễn phí của mình.

Đăng ký miễn phí để nhận 600 phút, hoặc nâng cấp từ $5/tháng cho hàng ngàn người khác.

10 phút miễn phí/ngày 600 phút miễn phí với đăng ký Không có thẻ tín dụng Đã mã hóa
Đăng ký miễn phí →
100+
Ngôn ngữ được hỗ trợ
10+
Mô hình AI
95%+
Chính xác
Tự do
600 phút để bắt đầu

Nó hoạt động thế nào?

1
Chọn ngôn ngữ

Chọn ngôn ngữ của âm thanh từ danh mục 100+ ngôn ngữ được hỗ trợ bên dưới.

2
Tải lên tập tin của bạn

Tải lên âm thanh hoặc video theo bất kỳ định dạng nào -- MP3, WAV, M4A, MP4, MKV, và 20+ định dạng khác được hỗ trợ.

3
Nhập mã

Tải về bản ghi của bạn dưới dạng TXT, SRT, VTT, DOCX, JSON, hoặc PDF. Sửa đổi, chia sẻ, hoặc tích hợp qua API.

Tất cả ngôn ngữ

Tại sao chọn STT.ai cho phiên âm đa ngôn ngữ?

Độ chính xác hàng đầu ngành công nghiệp

Mô hình AI của chúng tôi đạt được độ chính xác 93-95% + trên các ngôn ngữ chính. Chúng tôi hỗ trợ nhiều mô hình để bạn có thể chọn một trong những tốt nhất cho ngôn ngữ và trường hợp sử dụng của bạn.

Mọi định dạng được hỗ trợ

Tải lên âm thanh hay video theo bất kỳ định dạng nào. Xuất bản bản ghi như TXT, phụ đề SRT, phụ đề VTT, tài liệu DOCX, dữ liệu JSON, hoặc tập tin PDF.

Kiểm tra loa

Tự động xác định người nói đã nói gì. Tính năng này hoạt động trên tất cả các ngôn ngữ được hỗ trợ cho các cuộc họp, phỏng vấn, podcast, và nhiều hơn nữa.

Tư nhân trước

Âm thanh của bạn được xử lý và xóa theo mặc định. Không giữ dữ liệu trên các kế hoạch trả tiền. Các kế hoạch doanh nghiệp bao gồm và triển khai.

Sẵn sàng để chuyển ngữ chưa?

Bắt đầu miễn phí với 600 phút để bắt đầu. Không cần thẻ tín dụng.

Bắt đầu phiên âm

Câu hỏi thường gặp

phiên âm đa ngôn ngữ chạy trong trình duyệt của bạn: dán URL, tải lên tập tin, hay ghi âm từ mic của bạn. STT.ai chọn mô hình AI và trả lại bản ghi trong 5 phút. Xuất dạng TXT, SRT, VTT, DOCX, JSON, hoặc PDF.

Có — mỗi khách truy cập có 600 phút miễn phí để bắt đầu trên STT.ai, có thể sử dụng cho phiên âm đa ngôn ngữ giống như bất kỳ luồng công việc nào khác. Các kế hoạch trả tiền bắt đầu từ $5/tháng mở khóa các tập tin dài hơn, bản ghi riêng và xếp hàng ưu tiên.

phiên âm đa ngôn ngữ chạy trên cùng mô hình AI như phần còn lại của STT.ai — các mô hình tốt nhất của chúng tôi đạt đến độ chính xác 95-97% trong nói rõ (3-5% Tỷ lệ lỗi từ trong các tiêu chuẩn). Thay đổi mô hình khi bay nếu lần đầu đi qua dưới mục tiêu của bạn.

phiên âm đa ngôn ngữ có thể chạy trên bất kỳ STT.ai 10+ mẫu — STT.ai Enhanced (đúng nhất), Whisper Large V3 (99 ngôn ngữ), NVIDIA Canary (#1 WER trên langs hỗ trợ), Whisper Turbo (nhanh), Moonshine (nhẹ), và nhiều hơn nữa.

Có. Mỗi bản dịch được xuất thành SRT hoặc VTT — hoạt động với YouTube, Vimeo, TikTok, VLC, và mọi trình xem video lớn. Công cụ ghi phụ đề sẽ đặt chúng lên video như phần phụ đề.

Có. Tự động dán nhãn mỗi giọng nói (Giọng nói 1, Giọng nói 2,...) và bạn có thể đổi tên chúng trong trình biên tập nội bộ. Hoạt động trên tất cả các mẫu và ngôn ngữ.

Hầu hết phiên âm đa ngôn ngữ công việc hoàn thành trong 5 phút. Một tập tin âm thanh 1 giờ thường hoàn thành trong 2-3 phút với các mẫu nhanh nhất của chúng tôi. Tốc độ phụ thuộc vào mẫu chọn và tải CPU hiện tại.

phiên âm đa ngôn ngữ chấp nhận hơn 20 định dạng — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, và nhiều hơn nữa. Xuất thành TXT, SRT, VTT, DOCX, JSON, hoặc PDF.

Có. Tập tin âm thanh gửi đến phiên âm đa ngôn ngữ được xử lý và xóa theo mặc định. Các gói Pro thêm mã hóa bên khách — ngay cả khi cơ sở dữ liệu của STT.ai bị phá vỡ, bản ghi của bạn không đọc được nếu không có chìa khóa của bạn. Dữ liệu không bao giờ được dùng cho việc huấn luyện mô hình nếu không có sự đồng ý rõ ràng.

Có. STT.ai cung cấp một API REST với Python và Node.js SDKs, cộng thêm một máy chủ MCP cho Claude và Cursor — tất cả đều có thể sử dụng cho phiên âm đa ngôn ngữ workflows.

Có. Mỗi bản ghi sẽ được mở trong trình biên tập bên trong nơi bạn có thể sửa chữa từ, đổi tên người nói, điều chỉnh dấu thời gian, và thêm ghi chú. Tất cả các thay đổi sẽ được tự động lưu.

Mỗi bản ghi nhận có một URL có thể chia sẻ độc nhất. Xuất DOCX hoặc PDF cho email. Các kế hoạch Pro thêm liên kết bảo vệ mật khẩu và liên kết vĩnh viễn — hữu ích cho công việc khách hàng.

STT.ai xử lý 1.300+ nền tảng bao gồm YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, và nhiều hơn nữa. URL transcription works with publicly-available content only — DRM-protected sources cannot be transcribed.