Bộ sao chép giọng nói AI
Sao chép bất kỳ giọng nói nào từ một đoạn nhạc ngắn. Tải lên 3-10 giây giọng nói, gõ văn bản của bạn, và tạo ra âm thanh bằng cùng một giọng nói.
Clone: cung cấp đoạn trích tham khảo 3- 10s. Preset: chọn từ những giọng nói đa ngôn ngữ gói gọn.
Tải lên âm thanh tham chiếu giọng nói
MP3, WAV, M4A, FLAC
VibeVoice preset bao gồm tiếng Anh, Đức, Pháp, Nhật Bản, Hàn Quốc, Ba Lan, Bồ Đào Nha, Tây Ban Nha, Ý, Hà Lan.
Hơn 500 ký tự
0/500
Dùng 1 điểm mỗi thế hệ
Âm thanh được tạo ra
Âm thanh này được tạo bởi AI. Tập tin WAV đã tải xuống chứa một thông báo có thể đọc máy (mảnh RIFF INFO) theo Đạo luật AI EU Điều 50. Đừng trình bày âm thanh này như là ghi âm của một người thật mà không có sự đồng ý.
Chính sách AI
Nó hoạt động thế nào?
1
Tải lên tham chiếu
Cho 3-10 giây nói rõ từ giọng nói bạn muốn sao chép.
2
AI phân tích giọng nóiName
F5-TTS trích xuất các đặc điểm giọng nói: âm sắc, độ cao, phong cách nói, giọng điệu.
3
Tạo lời nói
Văn bản của bạn sẽ được nói bằng giọng nói sao chép. Tải kết quả dưới dạng WAV.
Bản sao giọng nói chỉ dành cho cá nhân và dùng được ủy quyền. Đừng sao giọng nói mà không có sự đồng ý của người nói.
Cần toàn bộ bản ghi chép, không chỉ là công cụ?
Upload audio or video, or paste a link — AI transcription in 100+ languages with speaker detection. 10 free minutes a day, no sign up.
Câu hỏi thường gặp
sao chép giọng nói chạy trong trình duyệt của bạn: dán URL, tải lên tập tin, hay ghi âm từ mic của bạn. STT.ai chọn mô hình AI và trả lại bản ghi trong 5 phút. Xuất dạng TXT, SRT, VTT, DOCX, JSON, hoặc PDF.
Có — mỗi khách truy cập có 600 phút miễn phí để bắt đầu trên STT.ai, có thể sử dụng cho sao chép giọng nói giống như bất kỳ luồng công việc nào khác. Các kế hoạch trả tiền bắt đầu từ $5/tháng mở khóa các tập tin dài hơn, bản ghi riêng và xếp hàng ưu tiên.
sao chép giọng nói chạy trên cùng mô hình AI như phần còn lại của STT.ai — các mô hình tốt nhất của chúng tôi đạt đến độ chính xác 95-97% trong nói rõ (3-5% Tỷ lệ lỗi từ trong các tiêu chuẩn). Thay đổi mô hình khi bay nếu lần đầu đi qua dưới mục tiêu của bạn.
sao chép giọng nói có thể chạy trên bất kỳ STT.ai 10+ mẫu — STT.ai Enhanced (đúng nhất), Whisper Large V3 (99 ngôn ngữ), NVIDIA Canary (#1 WER trên langs hỗ trợ), Whisper Turbo (nhanh), Moonshine (nhẹ), và nhiều hơn nữa.
Có. Mỗi bản dịch được xuất thành SRT hoặc VTT — hoạt động với YouTube, Vimeo, TikTok, VLC, và mọi trình xem video lớn. Công cụ ghi phụ đề sẽ đặt chúng lên video như phần phụ đề.
Có. Tự động dán nhãn mỗi giọng nói (Giọng nói 1, Giọng nói 2,...) và bạn có thể đổi tên chúng trong trình biên tập nội bộ. Hoạt động trên tất cả các mẫu và ngôn ngữ.
Hầu hết sao chép giọng nói công việc hoàn thành trong 5 phút. Một tập tin âm thanh 1 giờ thường hoàn thành trong 2-3 phút với các mẫu nhanh nhất của chúng tôi. Tốc độ phụ thuộc vào mẫu chọn và tải CPU hiện tại.
sao chép giọng nói chấp nhận hơn 20 định dạng — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI, và nhiều hơn nữa. Xuất thành TXT, SRT, VTT, DOCX, JSON, hoặc PDF.
Có. Tập tin âm thanh gửi đến sao chép giọng nói được xử lý và xóa theo mặc định. Các gói Pro thêm mã hóa bên khách — ngay cả khi cơ sở dữ liệu của STT.ai bị phá vỡ, bản ghi của bạn không đọc được nếu không có chìa khóa của bạn. Dữ liệu không bao giờ được dùng cho việc huấn luyện mô hình nếu không có sự đồng ý rõ ràng.
Có. STT.ai cung cấp một API REST với Python và Node.js SDKs, cộng thêm một máy chủ MCP cho Claude và Cursor — tất cả đều có thể sử dụng cho sao chép giọng nói workflows.
Có. Mỗi bản ghi sẽ được mở trong trình biên tập bên trong nơi bạn có thể sửa chữa từ, đổi tên người nói, điều chỉnh dấu thời gian, và thêm ghi chú. Tất cả các thay đổi sẽ được tự động lưu.
Mỗi bản ghi nhận có một URL có thể chia sẻ độc nhất. Xuất DOCX hoặc PDF cho email. Các kế hoạch Pro thêm liên kết bảo vệ mật khẩu và liên kết vĩnh viễn — hữu ích cho công việc khách hàng.
STT.ai xử lý 1.300+ nền tảng bao gồm YouTube, Vimeo, TikTok, SoundCloud, Zoom, Google Meet, podcast hosts, và nhiều hơn nữa. URL transcription works with publicly-available content only — DRM-protected sources cannot be transcribed.