Seguridad & Pribasiya
Totoong kung ano ang nangyayari sa iyong audio at transcripts sa bawat hakbang. Walang marketing fluff - lamang kung paano ito talagang gumagana.
Tatlong antas ng privacy
Pangkalahatang
- HTTPS (TLS 1.3) para sa lahat ng data sa transit
- Audio tinanggal kaagad pagkatapos ng pagpoproseso
- Transcripts naka-imbak sa aming database
- Maaari naming basahin ang naka-imbak na transcripts
- Data hindi kailanman nabili o ginagamit para sa pagsasanay
- I-delete ang iyong data anumang oras
Pribadong transcript
- Lahat ng bagay sa Standard, plus:
- Transcript naka-encrypt sa iyong browser (AES-256-GCM) bago i-save
- Nag-iimbak kami lamang encrypted data — hindi namin mababasa ito
- Key nagmula sa iyong password, hindi kailanman ipinadala sa amin
- ⚠ Audio ay pa rin naproseso sa aming mga server sa panahon ng transcription
Pribadong Cloud / Self-host
- Audio hindi kailanman umaalis sa iyong imprastraktura
- Transcription tumatakbo sa iyong GPU
- Walang data na ipinadala sa STT.ai server
- Air-gapped suporta na magagamit
- Tunay na end-to-end privacy
Ano ang aktwal na nangyayari sa iyong data
Isang transparent, hakbang-hakbang na breakdown ng kung paano ang iyong audio at transcript ay hinawakan.
Steps 1-2 ay pareho — ang iyong audio ay dapat na naproseso sa aming mga server upang makabuo ng transcript. Ang pagkakaiba ay kung ano ang mangyayari sa susunod:
Ano ang Makikita at Hindi Makikita
Hindi namin makikita (sa Private Transcript)
- Ang iyong naka-imbak na transcript teksto
- Speaker pangalan o label (na-imbak)
- Timestamps o salita-level data (na-imbak)
- Ang iyong susi o password sa pag-encrypt
Maaari naming makita (kahit na may pribadong transcript)
- Ang iyong audio sa panahon ng pagpoproseso (ipinagbabawal pagkatapos)
- File pangalan, laki, tagal (metadata)
- Wika natuklasan, modelo na ginagamit
- Timestamp ng transkripsiyon
- Ang iyong impormasyon sa account at pagbili
Teknolohiya detalye
| Encryption algorithm | AES-256-GCM (na-verify na pag-encrypt) |
| Key pagbubuo | Ang 2560 Aoyama ay isang planetang hindi pangunahin. |
| IV (paglilinaw) | Random 12 bytes bawat pag-encrypt (hindi kailanman muling ginamit) |
| Key imbakan | Hindi kailanman naka-imbak — nagmula sa password sa bawat session |
| Transportasyon encryption | TLS 1.3 (HTTPS) + HSTS (1 taon, preload) |
| Audio pagtitipid | Ginawa sa memorya, hindi kailanman nakasulat sa disk, tinanggal kaagad |
| Pagpapatupad | Web Crypto API (browser-orihinal, walang panlabas na mga aklatan) |
| Source code | github.com/sttaigit/stt-encryption (Lisensyang MIT) |
Mga Trade-off ng Pribadong Transcript
Pribadong transcript ay opt-in dahil ang pag-encrypt ng naka-imbak na transcript limitasyon ng ilang mga tampok:
- Pagtingin sa iyong mga transcript
- Pag-export (TXT, SRT, VTT, atbp.)
- Pag-download
- Pag-edit (decrypted sa browser)
- Server-side paghahanap sa buong transcripts
- AI buod at chat (server ay hindi maaaring basahin ang data)
- Pakikipag-ugnay sa publiko sa pamamagitan ng link
- Team workspace pakikipagtulungan
Kailangan Audio upang Huwag Kailanman Umalis ang Iyong mga Server?
Ang pribadong transcript ay pinoprotektahan ang transcript sa pagtulog, ngunit ang audio ay dumadaan pa rin sa aming GPU habang pinoproseso. Kung ang iyong mga kinakailangan sa pagsunod o seguridad ay nangangailangan na ang audio ay hindi kailanman humipo sa third-party na imprastraktura, ito ang iyong mga pagpipilian:
Pribadong Cloud
Dedicated GPU server pinamamahalaan sa pamamagitan ng amin. Ang iyong audio ay hindi kailanman umaalis sa iyong mga nakahiwalay na kapaligiran.
- Ang 100♠1000 ay isang taon sa kalendaryo.
- Isolation — walang ibinahaging imprastraktura
- Audio naproseso sa iyong hardware lamang
- Buong API access + SLA
Self-host
Docker imahe. Ang iyong mga server. Ang iyong GPU. Walang kailanman umaalis sa iyong network.
- Docker — tumatakbo sa anumang NVIDIA GPU
- Air-gapped suporta — walang internet kinakailangan
- Model mga update kasama
- Buong kontrol, buong privacy
Ang aming mga pangako (Lahat ng User, Lahat ng Plano)
- Ang mga file ng audio ay tinanggal sa loob ng 24 oras sa pamamagitan ng default. Ang tanging pagbubukod: kung pumipili ka sa "Mag-ambag ng mga pagwawasto + audio sa Voice Lab" sa Mga Setting ng Pagkapribado, ang audio ay maiimbak ng hanggang 90 araw habang ang mga pagwawasto-ang pinaka-cron ay nag-iimbak ng mga segment na na-clip sa ilalim ng CC-BY-SA-4.0. Mga Setting ng Privacy
- Ang iyong data ay hindi kailanman ginagamit para sa AI pagsasanay maliban kung malinaw mong pinili sa Mga Setting ng Privacy (text-only na pagsasanay sa pagwawasto at/o mga kontribusyon sa audio ng Voice Lab — pareho itong default na off). Mga Setting ng Privacy
- Hindi namin ibinebenta ang iyong data. Kailanman. Sa sinuman.
- Lahat ng trapiko na naka-encrypt sa transit Ang 1300 ay isang taon sa kalendaryo.
- I-delete ang iyong data anumang oras mula sa Mga Setting ng Privacy o sa pamamagitan ng pagtanggal ng iyong account. Mga Setting ng Privacy
- Encryption code ay bukas na mapagkukunan — suriin ito sa iyong sarili (MIT lisensya). audit ito sa iyong sarili
Open-source na pag-encrypt
Ang aming library ng pag-encrypt ay ganap na open-source sa ilalim ng MIT license. Huwag magtiwala sa amin — suriin ang code. Walang pagtitiwala na kinakailangan, lamang matematika.
Tingnan ang GitHub | Tingnan ang pinagmulanHanda na bang mag-transcribe nang ligtas?
I-upload ang iyong unang file nang libre. Pribadong transcripts magagamit sa Pro at Business plano.
Magsisimulang mag-translate