ນະໂຍບາຍ AI ແລະ ຄວາມສະຫວ່າງ
AI ທີ່ພວກເຮົາໃຊ້, ບ່ອນທີ່ມັນແລ່ນ, ແລະພວກເຮົາປະຕິບັດຕາມຂໍ້ຮຽກຮ້ອງໃນການເປີດເຜີຍ (EU AI Act ມາດຕາ 50, ມີຜົນບັງຄັບໃຊ້ 2026-08-02).
TL; DR
- ທຸກໆບົດບັນທຶກແມ່ນຖືກສ້າງຂຶ້ນໂດຍ AI. ຜົນອອກມາທຸກໆຢ່າງມີຂໍ້ມູນທີ່ອ່ານໄດ້ໂດຍເຄື່ອງ.
- AI ທັງຫມົດແລ່ນຢູ່ໃນ GPU ຂອງພວກເຮົາເອງ. ພວກເຮົາບໍ່ສົ່ງສຽງຫຼືຂໍ້ຄວາມຂອງທ່ານໄປ OpenAI, Anthropic, Google, ຫຼື API LLM ພາກສ່ວນທີສາມໃດໆ.
- ພວກເຮົາບໍ່ສອນແບບຈໍາລອງພື້ນຖານໃນ transcripts ຂອງທ່ານ. ມີພຽງແຕ່ opt-in fine-tune ນໍາໃຊ້ການແກ້ໄຂທີ່ທ່ານເຮັດຢ່າງຊັດເຈນ.
- ສຽງທີ່ຜະລິດຂຶ້ນມາໃໝ່ (TTS) ແມ່ນມີຊື່ວ່າ AI-generated ໃນຊື່ໄຟລ໌, metadata ແລະໃນໜ້າ.
ແບບທີ່ເຮົາໃຊ້
| ແບບ | ໃຊ້ເພື່ອ | ໃບອະນຸຍາດ | ແລ່ນຢູ່ |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | ແປເປັນພາສາອື່ນ (ປັນເດີມ) | MIT | GPU ຂອງພວກເຮົາ |
| STT.ai Enhanced (custom fine-tune) | ແປເປັນພາສາອື່ນ (ມີຄ່າໃຊ້ຈ່າຍ) | MIT (base) / Proprietary (fine-tune weights) | GPU ຂອງພວກເຮົາ |
| Vosk | ສົ່ງຂໍ້ຄວາມຜ່ານເວລາຈິງ | Apache 2.0 | GPU ຂອງພວກເຮົາ |
| SpeechBrain ECAPA-TDNN | ຕົວຈັດລຽງສຽງ | Apache 2.0 | GPU ຂອງພວກເຮົາ |
| MadLAD-400 3B | ການແປ (450+ ພາສາ) | Apache 2.0 | GPU ຂອງພວກເຮົາ |
| Qwen2.5-1.5B (llama.cpp) | ສັງລວມ, ການວິເຄາະ, ການສ້າງເນື້ອໃນ, ສົນທະນາ RAG | Apache 2.0 | GPU ຂອງພວກເຮົາ |
| F5-TTS | ສຽງແບບຄລາສສິກ / ຂໍ້ຄວາມເປັນສຽງ | MIT | GPU ຂອງພວກເຮົາ |
| all-MiniLM-L6-v2 | ການຝັງການຄົ້ນຫາ RAG | Apache 2.0 | GPU ຂອງພວກເຮົາ |
ພວກເຮົາບໍ່ເອີ້ນ OpenAI, Anthropic, Google Cloud, ຫຼືພາກສ່ວນທີສາມໃດ LLM API ສໍາລັບຄຸນລັກສະນະໃດຫນຶ່ງ. ທຸກໆແບບທີ່ກ່າວມາຂ້າງເທິງແລ່ນຢູ່ໃນຮາດແວທີ່ພວກເຮົາມີແລະປະຕິບັດ. ການບໍລິການ AI ນອກດຽວທີ່ພວກເຮົາໃຊ້ແມ່ນ translateapi.ai (ຍັງ Muddy Holdings) ສໍາລັບການແປ UI ສາຍ - ນີ້ບໍ່ເຄີຍ touches ເນື້ອໃນ transcribed ຂອງທ່ານ.
ວິທີການເປີດເຜີຍ AI ພັນ
- ແປບົດຄວາມ HTML: ລວມເອົາ <meta name=\
- ສົ່ງອອກຂໍ້ຄວາມ (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ລວມເອົາ 'AI-generated transcript' ສາຍຫົວຢູ່ເທິງຂອງທຸກໆເອກະສານ.
- ສຽງສະສົມ / ຜົນອອກແບບ TTS: ໄຟລ WAV ລວມມີແທັກ'synthetic-voice' ໃນຂໍ້ມູນເມຕາ ແລະ ແຈ້ງການທີ່ຈະແຈ້ງຢູ່ໃນໜ້າດາວໂຫລດ. ຂໍ້ຍົກເວັ້ນສຽງແມ່ນຢູ່ໃນແຜນທີ່ທາງເດີນ.
- ການຕອບຮັບ API: ລວມເອົາ _ai_generated: ພື້ນທີ່ຈິງໃນການຕອບໂຕ້ JSON ທຸກໆຄັ້ງທີ່ມີເນື້ອໃນທີ່ໄດ້ຖ່າຍທອດມາແລ້ວ.
ຂໍ້ມູນການຝຶກອົບຮົມ
- ແບບແບບພື້ນຖານ (Whisper, MadLAD, Qwen, ອື່ນໆ) ຖືກຝຶກກ່ອນຈາກຜູ້ພິມອອກມາ. ພວກເຮົາໃຊ້ພວກມັນຕາມທີ່ສົ່ງມາ.
- ບົດບັນທຶກຂອງທ່ານ ບໍ່ໄດ້ໃຊ້ເພື່ອຝຶກແບບແບບພື້ນຖານ.
- ຖ້າທ່ານແກ້ຂໍ້ຜິດພາດໃນການແປຂໍ້ຄວາມ (ຮູບປ້າຍພິມ) ຫຼື ເຮັດໃຫ້ມັນຜິດພາດ (ຮູບປ້າຍດອກໄມ້), ແລະທ່ານໄດ້ເລືອກໃນ / privacy- settings / (\
- ນອກນັ້ນ, ຕົວປ້ອນ ປະກອບສ່ວນການແກ້ໄຂເພີ່ມເຕີມສຽງໄປຍັງຫ້ອງທົດລອງສຽງ (ຍັງຢູ່ທີ່ /privacy-settings/, ຖືກປິດຕາມລຳດັບອີກດ້ວຍ) ອະນຸຍາດໃຫ້ທ່ານເລືອກເອົາການປະກອບສ່ວນສຽງຂອງສ່ວນທີ່ທ່ານໄດ້ແກ້ໄຂ, ຄູ່ກັບຂໍ້ຄວາມທີ່ໄດ້ແກ້ໄຂ, ໄປຍັງກຸ່ມຂໍ້ມູນຫ້ອງທົດລອງສຽງຂອງພວກເຮົາພາຍໃຕ້ CC-BY-SA-4.0. ຕົວປ້ອນສອງຢ່າງແມ່ນເປັນເອກະລາດ — ທ່ານສາມາດອະນຸຍາດໃຫ້ທັງສອງຢ່າງ ຫຼື ບໍ່ອະນຸຍາດໃຫ້ທັງສອງຢ່າງເລີຍ.
- ສຽງທີ່ທ່ານອັບໂຫລດຈະຖືກລຶບອອກພາຍໃນ 24 ຊົ່ວໂມງຜ່ານ cleanup_ uploads cron - UNLESS ທ່ານໄດ້ເລືອກໃນ\
ຄວາມຖືກຕ້ອງ ແລະ ຄວາມຜິດພາດ
AI transcription ແມ່ນບໍ່ສົມບູນແບບ. ອັດຕາຄວາມຜິດພາດຄໍາແຕກຕ່າງກັນໂດຍສຽງເວົ້າ, ຄຸນນະພາບສຽງ, ພາສາ, ແລະຄໍາສັບຂອງໂດເມນ. ສໍາລັບການໃຊ້ງານສໍາຄັນ (ກົດຫມາຍ, ທາງການແພດ, ອຸດສາຫະກໍາທີ່ກໍານົດໄວ້) ກວດສອບຕໍ່ຕ້ານສຽງຕົ້ນສະບັບ. ມາດຕະຖານສາທາລະນະ WER ຂອງພວກເຮົາຕໍ່ແບບແມ່ນຢູ່ /models/.
ຄໍາຖາມທີ່ສອດຄ່ອງ
ສໍາລັບ EU AI Act, GDPR, ຫຼືຄໍາຖາມອື່ນໆທີ່ຖືກຕ້ອງ: hello@stt.ai ຫຼືໃຊ້ ແບບຟອມຕິດຕໍ່.
ປັບປຸງຫຼ້າສຸດ: 2026-04-26.