AI Patakaran & Transparency
Ano ang AI na ginagamit namin, kung saan ito tumatakbo, at kung paano namin sumunod sa mga kinakailangan sa pag-iimbento (EU AI Act Artikulo 50, epektibo 2026-08-02).
Ang.tl ay ang Internet country code top-level domain (ccTLD) para sa Thailand.
- Lahat ng transcripts ay AI-buo. Ang bawat output ay nagdadala ng isang machine-mababasa na pagbubunyag.
- Lahat ng AI ay tumatakbo sa aming sariling GPU. Hindi namin ipadala ang iyong audio o teksto sa OpenAI, Anthropic, Google, o anumang third-party LLM API.
- Hindi namin tren base modelo sa iyong mga transcript. Lamang ng isang opt-in fine-tune ay gumagamit ng mga pagwawasto mo malinaw na gumawa.
- Ang mga Synthetic voice clones (TTS) ay malinaw na naka-label bilang AI-generated sa pangalan ng file, metadata, at sa pahina.
Mga modelo na ginagamit namin
| Modelo | Ginagamit para sa | Lisensya | Nagtatakbo sa |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | Pagsalin (default) | MIT | Ang aming GPU |
| STT.ai Enhanced (custom fine-tune) | Transcription (nababayaran plano) | MIT (base) / Proprietary (fine-tune weights) | Ang aming GPU |
| Vosk | Real-time na salita streaming | Apache 2.0 | Ang aming GPU |
| SpeechBrain ECAPA-TDNN | Speaker diarization | Apache 2.0 | Ang aming GPU |
| MadLAD-400 3B | Pagsasalin (450+ wika) | Apache 2.0 | Ang aming GPU |
| Qwen2.5-1.5B (llama.cpp) | Buod, pagtatasa, pagbuo ng nilalaman, RAG chat | Apache 2.0 | Ang aming GPU |
| F5-TTS | Voice cloning / teksto-sa-pagsasalita | MIT | Ang aming GPU |
| all-MiniLM-L6-v2 | Embeddings para sa RAG paghahanap | Apache 2.0 | Ang aming GPU |
Hindi namin tinatawag OpenAI, Anthropic, Google Cloud, o anumang third-party LLM API para sa anumang tampok. Ang bawat modelo sa itaas ay tumatakbo sa hardware namin pagmamay-ari at operating. Ang tanging panlabas AI serbisyo namin gamitin ay translateapi.ai (din Muddy Holdings) para sa pagsasalin UI string — ito ay hindi kailanman touching iyong transcribed nilalaman.
Paano namin ihayag AI henerasyon
- Mga pahina ng HTML: Ang "Meta" ay maaaring tumukoy sa: Meta
- Ang mga export ng teksto (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): <i> Magsama ng isang 'AI-nabubuo transcript' header linya sa tuktok ng bawat file.
- Sintetiko boses / TTS output: WAV file isama ang isang'synthetic-voice' tag sa metadata at isang malinaw na abiso sa pahina ng pag-download. Mapakinggan disclaimer ay sa roadmap.
- API tugon: Ang mga ito ay: Ang mga karaniwang uri ng mga selula ay: Ang mga selula ay may mga selula na may mga selula na may mga selula.
Pagsasanay data
- Base modelo (Whisper, MadLAD, Qwen, atbp) dumating pre-trained mula sa kanilang mga publisher. Ginagamit namin ang mga ito bilang-shipped.
- Ang iyong mga transcript ay hindi ginagamit upang magsanay base modelo.
- Kung itama mo ang isang transcript segment (ang lapis icon) o markahan ito hindi tama (ang flag icon), AT ikaw ay opted sa sa / privacy-settings / (\
- Hiwalay, ang Contribute corrections plus audio to Voice Lab toggle (na matatagpuan din sa /privacy-settings/, default na hindi na magagamit) ay nagpapahintulot sa iyo na mag-ambag ng audio ng mga segment na iyong kinorekta, kasama ang na-korrektang teksto, sa aming Voice Lab dataset sa ilalim ng CC-BY-SA-4.0. Ang dalawang toggle ay independiyente — maaari mong bigyan ng alinman, pareho, o wala.
- Audio na-upload mo ay tinanggal sa loob ng 24 oras sa pamamagitan ng cleanup_uploads cron — maliban kung ikaw ay nag-opt sa \
Katumpakan at mga error
AI transcription ay hindi perpekto. Word error rate ay nag-iiba sa pamamagitan ng speaker accent, kalidad ng audio, wika, at domain bokabularyo. Para sa kritikal na paggamit (legal, medikal, regulated industriya) suriin laban sa orihinal na audio. Ang aming mga pampublikong WER benchmarks bawat modelo ay sa /models/.
Mga katanungan sa pagsunod
Para sa EU AI Act, GDPR, o iba pang mga katanungan sa pagsunod: hello@stt.ai o gamitin ang form ng contact.
Huling na-update: 2026-04-26.