Free AI Từ nói sang văn bản
Transcript audio & video to text in 100+ languages. Multiple Whisper models. Speaker detection. No registration required.
Được các chuyên gia tin tưởng trên toàn thế giới
Mô hình chuyển từ nói sang văn bản
Chọn bộ xử lý âm thanh tốt nhất
STT.ai hoạt động như thế nào
Ba bước để phiên âm chính xác
1. Tải lên, ghi, hoặc dán URL
Kéo và thả bất kỳ tập tin âm thanh hay video nào (MP3, WAV, MP4, và hơn 20 định dạng). Ghi âm từ micro của bạn trong thời gian thực. Hoặc dán một liên kết từ YouTube, Vimeo, TikTok, và hơn 1.300 nền tảng.
2. AI Transcribes with Your Choice of Model
Chọn mô hình Whisper phù hợp: Tăng cường (v3 lớn, chính xác nhất), Turbo (nhanh, mặc định), Trung bình hoặc Nhỏ. Tự động phát hiện ngôn ngữ từ 99 tùy chọn. Đoạn nói xác định ai nói gì.
3. Xuất, chia sẻ, hoặc tích hợp
Tải về dạng TXT, SRT, VTT, DOCX, JSON, hoặc PDF. Chia sẻ qua liên kết. Dùng API của chúng tôi để tích hợp phiên dịch vào ứng dụng của bạn. Tốt cho phụ đề, ghi chú cuộc họp, podcast, và nhiều hơn nữa.
Mọi thứ bạn cần cho âm thanh và hình ảnhName
70+ công cụ miễn phí được hỗ trợ bởi AI
API của nhà phát triển
Tạo và chia sẻ các video trên YouTube. ^ “Review: The RESTful API with WebSocket streaming”.
import requests
response = requests.post(
"https://api.stt.ai/v1/transcribe",
headers={"Authorization": f"Bearer {API_KEY}"},
files={"file": open("meeting.mp3", "rb")},
data={
"model": "large-v3-turbo",
"language": "auto",
"diarize": "true",
"response_format": "json",
},
)
result = response.json()
for seg in result["segments"]:
print(f"{seg['speaker']}: {seg['text']}")
Đang chuyển từ dịch vụ nói khác sang dịch vụ văn bản?
Đơn giản, giá cả minh bạch
Bắt đầu tự do, tăng dần khi bạn lớn lên.
Sẵn sàng để ghi lại chưa?
Tải lên tập tin đầu tiên miễn phí, không cần thẻ tín dụng, không cần đăng ký, 600 phút để bắt đầu miễn phí.
Bắt đầu phiên âm