Polisi AI & Kelutsinaran

AI apa yang kita gunakan, di mana ia berjalan, dan bagaimana kita mematuhi keperluan pendedahan (EU AI Act Article 50, berkesan 2026-08-02).

TL;DR

  • Semua transkripsi dihasilkan AI. Setiap output membawa satu mesin-bacaan pendedahan.
  • Semua AI berjalan pada GPU kami sendiri. Kami TIDAK menghantar audio atau teks anda ke OpenAI, Anthropic, Google, atau mana-mana pihak ketiga LLM API.
  • Kami TIDAK melatih mana-mana model pada transkripsi anda. Setiap model yang kami jalankan adalah model sumber terbuka yang dikeluarkan dari rak. Pembetulan yang anda buat secara eksplisit hanya dikumpulkan jika anda memilih.
  • Klon suara sintetik (TTS) dilabelkan sebagai AI-jana dalam nama fail, metadata, dan pada halaman.

Model yang kita gunakan

ModelDigunakan untukLesenBerlaku pada
Whisper large-v3-turbo (faster-whisper)TranskripMITGPU kami
Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced”Transkripsi (rancangan berbayar)MITGPU kami
VoskStrim kata masa-nyataApache 2.0GPU kami
SpeechBrain ECAPA-TDNNDiarisasi SpeakerApache 2.0GPU kami
MadLAD-400 3BTerjemahan (450+ bahasa)Apache 2.0GPU kami
Qwen2.5-1.5B (llama.cpp)Ringkasan, analisis, penjanaan kandungan, sembang RAGApache 2.0GPU kami
F5-TTSKlon suara / teks-ke-tuturMITGPU kami
all-MiniLM-L6-v2Penyambung untuk carian RAGApache 2.0GPU kami

"STT.ai Enhanced" ialah nama produk kami untuk Whisper besar-v3 berjalan pada GPU kami sendiri. Ia bukan model tersendiri, penyelarasan halus, atau berat milik — ia adalah titik periksa Whisper terbesar dan paling tepat. Ia lebih tepat daripada Whisper piawai besar-v3-turbo, dan kira-kira 1.5x lebih perlahan pada kerja diurnal, diukur pada perkakasan kami sendiri.

Kami tidak memanggil OpenAI, Anthropic, Google Cloud, atau API pihak ketiga LLM untuk sebarang ciri. Setiap model di atas berjalan pada perkakasan kami yang kami miliki dan operasi. Satu-satunya perkhidmatan AI luaran yang kami gunakan adalah translateapi.ai (juga Muddy Holdings) untuk menerjemah rentetan UI — ini tidak pernah menyentuh kandungan transkripsi anda.

Bagaimana kita mendedahkan generasi AI

  • Halaman HTML transkript: termasuk <nama meta=\
  • Eksport teks (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): termasuk baris pengepala 'transkripsi AI-jana' pada bahagian atas setiap fail.
  • Output suara sintetik / TTS: Fail WAV termasuk tag'synthetic-voice' dalam metadata dan pemberitahuan jelas pada halaman muat turun. Pengisytiharan boleh dengar adalah pada peta jalan.
  • Balasan API: masukkan medan _ai_generated: true dalam setiap maklum balas JSON yang mengandungi kandungan yang ditranskripsikan.

Data latihan

  • Model asas (Whisper, MadLAD, Qwen, dll) datang pra-dilatih dari penerbit masing-masing. Kami menggunakan mereka sebagai-di-hantar.
  • Transkripsi awak bukannya digunakan untuk melatih model asas.
  • Jika anda betulkan segmen transkript (ikon pensil) atau tanda ia salah (ikon bendera), DAN anda telah memilih pada /privacy-settings/ ("Model Training" togol, lalai OFF), pasangan (teks salah → teks betul) boleh dikumpulkan untuk melatih model pembaikan teks masa depan. Hanya pasangan teks — tidak pernah audio sekeliling — digunakan oleh laluan ini. Tiada model seperti itu wujud hari ini: pasangan hanya disimpan, dan tiada apa yang kita kini sediakan telah dilatih pada mereka.
  • Secara berasingan, togol Beri sumbangan pembetulan plus audio ke Voice Lab (juga pada /privacy-settings/, juga lalai dimatikan) memilih anda untuk memberi sumbangan audio segmen yang anda betulkan, dipadankan dengan teks yang betulkan, ke set data Voice Lab kami di bawah CC-BY-SA-4.0. Dua togol ini adalah bebas — anda boleh berikan salah satu, kedua-duanya, atau tidak.
  • Audio yang anda muat naik akan dipadam dalam masa 24 jam melalui cron cleanup_uploads — KEcuali anda telah memilih untuk \

Ketepatan dan ralat

Transkripsi AI tidak sempurna. Kadar ralat perkataan bervariasi mengikut loghat pembicara, kualiti audio, bahasa, dan kosa kata domain. Untuk penggunaan kritikal (hukum, perubatan, industri terkawal) semak dengan audio asal. Benchmark WER awam kami bagi setiap model adalah pada /models/.

Soalan Keserasian

Untuk EU AI Act, GDPR, atau soalan kepatuhan lain: hello@stt.ai atau gunakan contact form.

Terakhir dikemaskini: 2026-08-05.