Polisi AI & Kelutsinaran
AI apa yang kita gunakan, di mana ia berjalan, dan bagaimana kita mematuhi keperluan pendedahan (EU AI Act Article 50, berkesan 2026-08-02).
TL;DR
- Semua transkripsi dihasilkan AI. Setiap output membawa satu mesin-bacaan pendedahan.
- Semua AI berjalan pada GPU kami sendiri. Kami TIDAK menghantar audio atau teks anda ke OpenAI, Anthropic, Google, atau mana-mana pihak ketiga LLM API.
- Kami TIDAK melatih model asas pada transkripsi anda. Hanya opt-in fine-tune menggunakan pembetulan yang anda jelas membuat.
- Klon suara sintetik (TTS) dilabelkan sebagai AI-jana dalam nama fail, metadata, dan pada halaman.
Model yang kita gunakan
| Model | Digunakan untuk | Lesen | Berlaku pada |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Transkrip | MIT | GPU kami |
| STT.ai Enhanced (custom fine-tune) | Transkripsi (rancangan berbayar) | MIT (base) / Proprietary (fine-tune weights) | GPU kami |
| Vosk | Strim kata masa-nyata | Apache 2.0 | GPU kami |
| SpeechBrain ECAPA-TDNN | Diarisasi Speaker | Apache 2.0 | GPU kami |
| MadLAD-400 3B | Terjemahan (450+ bahasa) | Apache 2.0 | GPU kami |
| Qwen2.5-1.5B (llama.cpp) | Ringkasan, analisis, penjanaan kandungan, sembang RAG | Apache 2.0 | GPU kami |
| F5-TTS | Klon suara / teks-ke-tutur | MIT | GPU kami |
| all-MiniLM-L6-v2 | Penyambung untuk carian RAG | Apache 2.0 | GPU kami |
Kami tidak memanggil OpenAI, Anthropic, Google Cloud, atau API pihak ketiga LLM untuk sebarang ciri. Setiap model di atas berjalan pada perkakasan kami yang kami miliki dan operasi. Satu-satunya perkhidmatan AI luaran yang kami gunakan adalah translateapi.ai (juga Muddy Holdings) untuk menerjemah rentetan UI — ini tidak pernah menyentuh kandungan transkripsi anda.
Bagaimana kita mendedahkan generasi AI
- Halaman HTML transkript: termasuk <nama meta=\
- Eksport teks (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): termasuk baris pengepala 'transkripsi AI-jana' pada bahagian atas setiap fail.
- Output suara sintetik / TTS: Fail WAV termasuk tag'synthetic-voice' dalam metadata dan pemberitahuan jelas pada halaman muat turun. Pengisytiharan boleh dengar adalah pada peta jalan.
- Balasan API: masukkan medan _ai_generated: true dalam setiap maklum balas JSON yang mengandungi kandungan yang ditranskripsikan.
Data latihan
- Model asas (Whisper, MadLAD, Qwen, dll) datang pra-dilatih dari penerbit masing-masing. Kami menggunakan mereka sebagai-di-hantar.
- Transkripsi awak bukannya digunakan untuk melatih model asas.
- Jika anda betulkan segmen transkripsi (ikon pensil) atau tandakan ia salah (ikon bendera), DAN anda telah memilih di /privacy-settings/ (\
- Secara berasingan, togol Beri sumbangan pembetulan plus audio ke Voice Lab (juga pada /privacy-settings/, juga lalai dimatikan) memilih anda untuk memberi sumbangan audio segmen yang anda betulkan, dipadankan dengan teks yang betulkan, ke set data Voice Lab kami di bawah CC-BY-SA-4.0. Dua togol ini adalah bebas — anda boleh berikan salah satu, kedua-duanya, atau tidak.
- Audio yang anda muat naik akan dipadam dalam masa 24 jam melalui cron cleanup_uploads — KEcuali anda telah memilih untuk \
Ketepatan dan ralat
Transkripsi AI tidak sempurna. Kadar ralat perkataan bervariasi mengikut loghat pembicara, kualiti audio, bahasa, dan kosa kata domain. Untuk penggunaan kritikal (hukum, perubatan, industri terkawal) semak dengan audio asal. Benchmark WER awam kami bagi setiap model adalah pada /models/.
Soalan Keserasian
Untuk EU AI Act, GDPR, atau soalan kepatuhan lain: hello@stt.ai atau gunakan contact form.
Terakhir dikemaskini: 2026-04-26.