Polisi AI & Kelutsinaran
AI apa yang kita gunakan, di mana ia berjalan, dan bagaimana kita mematuhi keperluan pendedahan (EU AI Act Article 50, berkesan 2026-08-02).
TL;DR
- Semua transkripsi dihasilkan AI. Setiap output membawa satu mesin-bacaan pendedahan.
- Semua AI berjalan pada GPU kami sendiri. Kami TIDAK menghantar audio atau teks anda ke OpenAI, Anthropic, Google, atau mana-mana pihak ketiga LLM API.
- Kami TIDAK melatih mana-mana model pada transkripsi anda. Setiap model yang kami jalankan adalah model sumber terbuka yang dikeluarkan dari rak. Pembetulan yang anda buat secara eksplisit hanya dikumpulkan jika anda memilih.
- Klon suara sintetik (TTS) dilabelkan sebagai AI-jana dalam nama fail, metadata, dan pada halaman.
Model yang kita gunakan
| Model | Digunakan untuk | Lesen | Berlaku pada |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transkrip | MIT | GPU kami |
| Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced” | Transkripsi (rancangan berbayar) | MIT | GPU kami |
| Vosk | Strim kata masa-nyata | Apache 2.0 | GPU kami |
| SpeechBrain ECAPA-TDNN | Diarisasi Speaker | Apache 2.0 | GPU kami |
| MadLAD-400 3B | Terjemahan (450+ bahasa) | Apache 2.0 | GPU kami |
| Qwen2.5-1.5B (llama.cpp) | Ringkasan, analisis, penjanaan kandungan, sembang RAG | Apache 2.0 | GPU kami |
| F5-TTS | Klon suara / teks-ke-tutur | MIT | GPU kami |
| all-MiniLM-L6-v2 | Penyambung untuk carian RAG | Apache 2.0 | GPU kami |
"STT.ai Enhanced" ialah nama produk kami untuk Whisper besar-v3 berjalan pada GPU kami sendiri. Ia bukan model tersendiri, penyelarasan halus, atau berat milik — ia adalah titik periksa Whisper terbesar dan paling tepat. Ia lebih tepat daripada Whisper piawai besar-v3-turbo, dan kira-kira 1.5x lebih perlahan pada kerja diurnal, diukur pada perkakasan kami sendiri.
Kami tidak memanggil OpenAI, Anthropic, Google Cloud, atau API pihak ketiga LLM untuk sebarang ciri. Setiap model di atas berjalan pada perkakasan kami yang kami miliki dan operasi. Satu-satunya perkhidmatan AI luaran yang kami gunakan adalah translateapi.ai (juga Muddy Holdings) untuk menerjemah rentetan UI — ini tidak pernah menyentuh kandungan transkripsi anda.
Bagaimana kita mendedahkan generasi AI
- Halaman HTML transkript: termasuk <nama meta=\
- Eksport teks (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): termasuk baris pengepala 'transkripsi AI-jana' pada bahagian atas setiap fail.
- Output suara sintetik / TTS: Fail WAV termasuk tag'synthetic-voice' dalam metadata dan pemberitahuan jelas pada halaman muat turun. Pengisytiharan boleh dengar adalah pada peta jalan.
- Balasan API: masukkan medan _ai_generated: true dalam setiap maklum balas JSON yang mengandungi kandungan yang ditranskripsikan.
Data latihan
- Model asas (Whisper, MadLAD, Qwen, dll) datang pra-dilatih dari penerbit masing-masing. Kami menggunakan mereka sebagai-di-hantar.
- Transkripsi awak bukannya digunakan untuk melatih model asas.
- Jika anda betulkan segmen transkript (ikon pensil) atau tanda ia salah (ikon bendera), DAN anda telah memilih pada /privacy-settings/ ("Model Training" togol, lalai OFF), pasangan (teks salah → teks betul) boleh dikumpulkan untuk melatih model pembaikan teks masa depan. Hanya pasangan teks — tidak pernah audio sekeliling — digunakan oleh laluan ini. Tiada model seperti itu wujud hari ini: pasangan hanya disimpan, dan tiada apa yang kita kini sediakan telah dilatih pada mereka.
- Secara berasingan, togol Beri sumbangan pembetulan plus audio ke Voice Lab (juga pada /privacy-settings/, juga lalai dimatikan) memilih anda untuk memberi sumbangan audio segmen yang anda betulkan, dipadankan dengan teks yang betulkan, ke set data Voice Lab kami di bawah CC-BY-SA-4.0. Dua togol ini adalah bebas — anda boleh berikan salah satu, kedua-duanya, atau tidak.
- Audio yang anda muat naik akan dipadam dalam masa 24 jam melalui cron cleanup_uploads — KEcuali anda telah memilih untuk \
Ketepatan dan ralat
Transkripsi AI tidak sempurna. Kadar ralat perkataan bervariasi mengikut loghat pembicara, kualiti audio, bahasa, dan kosa kata domain. Untuk penggunaan kritikal (hukum, perubatan, industri terkawal) semak dengan audio asal. Benchmark WER awam kami bagi setiap model adalah pada /models/.
Soalan Keserasian
Untuk EU AI Act, GDPR, atau soalan kepatuhan lain: hello@stt.ai atau gunakan contact form.
Terakhir dikemaskini: 2026-08-05.