Chính sách AI và minh bạch

AI chúng tôi sử dụng, nơi nó chạy, và cách chúng tôi tuân thủ các yêu cầu tiết lộ (EU AI Act Article 50, có hiệu lực 2026-08-02).

TL;DR

  • Tất cả các bản ghi được tạo ra bởi AI.
  • Tất cả AI chạy trên GPU của chúng tôi. Chúng tôi không gửi âm thanh hay văn bản của bạn đến OpenAI, Anthropic, Google, hay bất kỳ API LLM thứ ba nào.
  • Chúng tôi không huấn luyện mô hình cơ sở trên bản ghi của anh. Chỉ có một sự điều chỉnh tinh vi chọn lọc sử dụng các sửa chữa mà anh đã làm rõ ràng.
  • Synthetic voice clones (TTS) được đánh dấu rõ ràng như AI-genered trong tên tập tin, siêu dữ liệu, và trên trang.

Các mẫu chúng tôi sử dụng

Mô hìnhDùng choGiấy phépChạy tiếp
Whisper large-v3-turbo (faster-whisper)Phiên âm (mặc định)MITGPU của chúng ta
STT.ai Enhanced (custom fine-tune)Transcript (kế hoạch trả tiền)MIT (base) / Proprietary (fine-tune weights)GPU của chúng ta
VoskTruyền từ thời gian thựcApache 2.0GPU của chúng ta
SpeechBrain ECAPA-TDNNĐiều chỉnh loaApache 2.0GPU của chúng ta
MadLAD-400 3BDịch (450+ ngôn ngữ) NameApache 2.0GPU của chúng ta
Qwen2.5-1.5B (llama.cpp)Tóm tắt, phân tích, tạo nội dung, trò chuyện RAGApache 2.0GPU của chúng ta
F5-TTSBản sao giọng nói / văn bản- thành- nóiMITGPU của chúng ta
all-MiniLM-L6-v2Tìm kiếm RAGNameApache 2.0GPU của chúng ta

Chúng tôi không gọi OpenAI, Anthropic, Google Cloud, hay bất kỳ API LLM thứ ba nào cho bất kỳ tính năng nào. Mỗi mô hình trên chạy trên phần cứng mà chúng tôi sở hữu và điều hành. Dịch vụ AI bên ngoài duy nhất chúng tôi sử dụng là translateapi.ai (cũng là Muddy Holdings) để dịch các chuỗi UI — điều này không bao giờ chạm vào nội dung được phiên âm của bạn.

Cách chúng tôi tiết lộ thế hệ AI

  • Bản dịch trang HTML: include <meta name=\
  • Xuất văn bản (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): bao gồm dòng đầu 'AI-generated transcript' ở trên cùng của mỗi tập tin.
  • Giọng nói tổng hợp / TTS xuất: Tập tin WAV bao gồm một thẻ'synthetic-voice' trong siêu dữ liệu và một thông báo rõ ràng trên trang tải xuống. Thông báo không trách nhiệm nghe được là trên bản đồ.
  • Phản hồi API: bao gồm một _ai_generated: true field trong mỗi đáp ứng JSON chứa nội dung được phiên âm.

Dữ liệu huấn luyện

  • Các mô hình cơ bản (Whisper, MadLAD, Qwen, v.v.) được đào tạo sẵn từ các nhà xuất bản. Chúng tôi sử dụng chúng như đã được gửi.
  • Transcript của anh không được dùng để huấn luyện mẫu cơ sở.
  • Nếu bạn sửa một đoạn phiên âm (biểu tượng bút chì) hoặc đánh dấu nó là không chính xác (biểu tượng cờ), VÀ bạn đã chọn ở / privacy- settings / (\
  • Ngoài ra, tùy chọn Contribute corrections plus audio to Voice Lab (cũng ở /privacy-settings/, cũng bị tắt mặc định) cho phép bạn chọn góp phần âm thanh của các đoạn bạn sửa, kết hợp với văn bản được sửa, vào tập dữ liệu Voice Lab của chúng tôi theo CC-BY-SA-4.0. Hai tùy chọn này độc lập — bạn có thể cho phép cả hai hoặc không cho phép cả hai.
  • Âm thanh bạn tải lên sẽ bị xóa trong vòng 24 giờ thông qua cron cleanup_ uploads — TRƯỚC khi bạn đã chọn \

Chính xác và lỗi

Phiên âm AI không hoàn hảo. Tỷ lệ lỗi từ khác nhau tùy theo giọng nói, chất lượng âm thanh, ngôn ngữ, và từ vựng miền. Đối với việc sử dụng quan trọng (luật, y tế, ngành công nghiệp được điều chỉnh) kiểm tra với âm thanh gốc. Điểm chuẩn WER công cộng của chúng tôi cho mỗi mô hình là /models/.

Câu hỏi tuân thủ

Đối với Đạo luật AI EU, GDPR, hoặc các câu hỏi tuân thủ khác: hello@stt.ai hoặc dùng contact form.

Cập nhật cuối: 2026-04-26.