Free Audio to Text Online
Convert audio to text with AI-powered transcription. Upload audio files, record from your microphone, or paste a URL. 100+ languages, 10+ models, 98%+ accuracy.
1. Upload Audio
Upload MP3, WAV, M4A, FLAC, OGG, or any audio format. Up to 2GB.
2. AI Processes Audio
AI extracts speech from your audio with speaker detection and timestamps.
3. Get Your Transcript
View, edit, download, or share. Export as TXT, SRT, VTT, DOCX, or PDF.
Audio to Text Models
Choose the AI model that fits your needs — or let us pick the best one.
Transcribe Audio in 100+ Languages
Ready to convert audio to text?
Bắt đầu miễn phí →Câu hỏi thường gặp
Tải lên tập tin âm thanh của bạn hoặc dán URL, chọn một mô hình AI, và nhấn Transcribe. STT.ai trả về văn bản có thể chỉnh sửa với dấu thời gian và nhãn người nói — hầu hết các tập tin hoàn thành trong vòng dưới năm phút.
MP3, WAV, M4A, FLAC, OGG, AAC, AMR, và 10+ hơn được hỗ trợ. Bạn không cần phải chuyển đổi giữa các định dạng trước — tải lên bất kỳ thứ gì máy ghi âm hoặc ứng dụng của bạn tạo ra.
Một chút. Các định dạng không mất như WAV và FLAC mang âm thanh hoàn hảo, vì vậy độ chính xác chỉ bị giới hạn bởi mẫu và độ rõ của loa. Các định dạng mất (MP3, M4A) ở 128 kbps hoặc cao hơn có hiệu quả giống nhau; tốc độ bit rất thấp dưới 64 kbps có thể tốn một vài điểm.
STT.ai bao gồm 600 phút miễn phí để bắt đầu mà không cần đăng ký cho tập tin đầu tiên của bạn. Các kế hoạch trả tiền bắt đầu từ $5/tháng thêm các tập tin dài hơn, bản dịch riêng và xử lý ưu tiên.
Trong âm thanh sạch, các mô hình tốt nhất của chúng tôi đạt được độ chính xác 95-97% (tỷ lệ lỗi từ 3-5%). Âm thanh nền, loa chồng chéo và giọng nói mạnh là các yếu tố chính làm giảm độ chính xác.
Người dùng miễn phí có thể chuyển ngữ đến một giờ mỗi tập tin; các kế hoạch trả tiền mở rộng đến 8+ giờ, bao gồm podcast dài, phỏng vấn và sách âm thanh trong một lần duy nhất.
Có. Tính toán âm thanh ghi nhãn mỗi giọng nói (Giọng nói 1, Giọng nói 2,...) và bạn có thể đổi tên chúng trong trình biên tập — hoạt động trên mọi định dạng và mẫu âm thanh được hỗ trợ.
Xuất sang định dạng TXT, DOCX, PDF, JSON, hoặc phụ đề SRT/ VTT. JSON giữ dấu thời gian đọc máy và nhãn phát thanh; DOCX và PDF tốt nhất cho việc chia sẻ và lưu trữ.
Có. Hơn 100 ngôn ngữ với khả năng tự động phát hiện, cộng thêm tùy chọn để đặt ngôn ngữ bằng tay. Âm thanh hỗn hợp ngôn ngữ được xử lý bằng cách chuyển giữa tập tin, và bạn có thể dịch kết quả sau đó.
Có. Âm thanh được xử lý và xóa theo mặc định, và các kế hoạch Pro thêm mã hóa bên khách để các bản ghi không đọc được nếu không có chìa khóa của bạn. Không có gì được dùng cho huấn luyện nếu không chọn vào.
Đúng. dán một liên kết từ bất kỳ 1,300+ nền tảng hỗ trợ — podcast hosts, SoundCloud, YouTube, và nhiều hơn — và STT.ai lấy âm thanh trực tiếp. DRM-protected sources cannot be transcribed.
Có. API REST chấp nhận các tập tin âm thanh trực tiếp, với Python và Node.js SDK và một cấp miễn phí 100 phút/tháng. Chi phí theo giây áp dụng ngoài cấp miễn phí.