Polisi AI & Kelutsinaran

AI apa yang kita gunakan, di mana ia berjalan, dan bagaimana kita mematuhi keperluan pendedahan (EU AI Act Article 50, berkesan 2026-08-02).

TL;DR

  • Semua transkripsi dihasilkan AI. Setiap output membawa satu mesin-bacaan pendedahan.
  • Semua AI berjalan pada GPU kami sendiri. Kami TIDAK menghantar audio atau teks anda ke OpenAI, Anthropic, Google, atau mana-mana pihak ketiga LLM API.
  • Kami TIDAK melatih model asas pada transkripsi anda. Hanya opt-in fine-tune menggunakan pembetulan yang anda jelas membuat.
  • Klon suara sintetik (TTS) dilabelkan sebagai AI-jana dalam nama fail, metadata, dan pada halaman.

Model yang kita gunakan

ModelDigunakan untukLesenBerlaku pada
Whisper large-v3-turbo (faster-whisper)TranskripMITGPU kami
STT.ai Enhanced (custom fine-tune)Transkripsi (rancangan berbayar)MIT (base) / Proprietary (fine-tune weights)GPU kami
VoskStrim kata masa-nyataApache 2.0GPU kami
SpeechBrain ECAPA-TDNNDiarisasi SpeakerApache 2.0GPU kami
MadLAD-400 3BTerjemahan (450+ bahasa)Apache 2.0GPU kami
Qwen2.5-1.5B (llama.cpp)Ringkasan, analisis, penjanaan kandungan, sembang RAGApache 2.0GPU kami
F5-TTSKlon suara / teks-ke-tuturMITGPU kami
all-MiniLM-L6-v2Penyambung untuk carian RAGApache 2.0GPU kami

Kami tidak memanggil OpenAI, Anthropic, Google Cloud, atau API pihak ketiga LLM untuk sebarang ciri. Setiap model di atas berjalan pada perkakasan kami yang kami miliki dan operasi. Satu-satunya perkhidmatan AI luaran yang kami gunakan adalah translateapi.ai (juga Muddy Holdings) untuk menerjemah rentetan UI — ini tidak pernah menyentuh kandungan transkripsi anda.

Bagaimana kita mendedahkan generasi AI

  • Halaman HTML transkript: termasuk <nama meta=\
  • Eksport teks (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): termasuk baris pengepala 'transkripsi AI-jana' pada bahagian atas setiap fail.
  • Output suara sintetik / TTS: Fail WAV termasuk tag'synthetic-voice' dalam metadata dan pemberitahuan jelas pada halaman muat turun. Pengisytiharan boleh dengar adalah pada peta jalan.
  • Balasan API: masukkan medan _ai_generated: true dalam setiap maklum balas JSON yang mengandungi kandungan yang ditranskripsikan.

Data latihan

  • Model asas (Whisper, MadLAD, Qwen, dll) datang pra-dilatih dari penerbit masing-masing. Kami menggunakan mereka sebagai-di-hantar.
  • Transkripsi awak bukannya digunakan untuk melatih model asas.
  • Jika anda betulkan segmen transkripsi (ikon pensil) atau tandakan ia salah (ikon bendera), DAN anda telah memilih di /privacy-settings/ (\
  • Secara berasingan, togol Beri sumbangan pembetulan plus audio ke Voice Lab (juga pada /privacy-settings/, juga lalai dimatikan) memilih anda untuk memberi sumbangan audio segmen yang anda betulkan, dipadankan dengan teks yang betulkan, ke set data Voice Lab kami di bawah CC-BY-SA-4.0. Dua togol ini adalah bebas — anda boleh berikan salah satu, kedua-duanya, atau tidak.
  • Audio yang anda muat naik akan dipadam dalam masa 24 jam melalui cron cleanup_uploads — KEcuali anda telah memilih untuk \

Ketepatan dan ralat

Transkripsi AI tidak sempurna. Kadar ralat perkataan bervariasi mengikut loghat pembicara, kualiti audio, bahasa, dan kosa kata domain. Untuk penggunaan kritikal (hukum, perubatan, industri terkawal) semak dengan audio asal. Benchmark WER awam kami bagi setiap model adalah pada /models/.

Soalan Keserasian

Untuk EU AI Act, GDPR, atau soalan kepatuhan lain: hello@stt.ai atau gunakan contact form.

Terakhir dikemaskini: 2026-04-26.