ນະໂຍບາຍ AI ແລະ ຄວາມສະຫວ່າງ

AI ທີ່ພວກເຮົາໃຊ້, ບ່ອນທີ່ມັນແລ່ນ, ແລະພວກເຮົາປະຕິບັດຕາມຂໍ້ຮຽກຮ້ອງໃນການເປີດເຜີຍ (EU AI Act ມາດຕາ 50, ມີຜົນບັງຄັບໃຊ້ 2026-08-02).

TL; DR

  • ທຸກໆບົດບັນທຶກແມ່ນຖືກສ້າງຂຶ້ນໂດຍ AI. ຜົນອອກມາທຸກໆຢ່າງມີຂໍ້ມູນທີ່ອ່ານໄດ້ໂດຍເຄື່ອງ.
  • AI ທັງຫມົດແລ່ນຢູ່ໃນ GPU ຂອງພວກເຮົາເອງ. ພວກເຮົາບໍ່ສົ່ງສຽງຫຼືຂໍ້ຄວາມຂອງທ່ານໄປ OpenAI, Anthropic, Google, ຫຼື API LLM ພາກສ່ວນທີສາມໃດໆ.
  • ພວກເຮົາບໍ່ສອນແບບຈໍາລອງພື້ນຖານໃນ transcripts ຂອງທ່ານ. ມີພຽງແຕ່ opt-in fine-tune ນໍາໃຊ້ການແກ້ໄຂທີ່ທ່ານເຮັດຢ່າງຊັດເຈນ.
  • ສຽງທີ່ຜະລິດຂຶ້ນມາໃໝ່ (TTS) ແມ່ນມີຊື່ວ່າ AI-generated ໃນຊື່ໄຟລ໌, metadata ແລະໃນໜ້າ.

ແບບທີ່​ເຮົາ​ໃຊ້

ແບບໃຊ້​ເພື່ອໃບອະນຸຍາດແລ່ນ​ຢູ່
Whisper large-v3-turbo (faster-whisper)ແປ​ເປັນ​ພາສາ​ອື່ນ (ປັ​ນ​ເດີມ)MITGPU ຂອງພວກເຮົາ
STT.ai Enhanced (custom fine-tune)ແປ​ເປັນ​ພາສາ​ອື່ນ (ມີ​ຄ່າ​ໃຊ້​ຈ່າຍ)MIT (base) / Proprietary (fine-tune weights)GPU ຂອງພວກເຮົາ
Voskສົ່ງ​ຂໍ້ຄວາມ​ຜ່ານ​ເວລາ​ຈິງApache 2.0GPU ຂອງພວກເຮົາ
SpeechBrain ECAPA-TDNNຕົວ​ຈັດ​ລຽງ​ສຽງ​Apache 2.0GPU ຂອງພວກເຮົາ
MadLAD-400 3Bການ​ແປ (450+ ພາສາ)Apache 2.0GPU ຂອງພວກເຮົາ
Qwen2.5-1.5B (llama.cpp)ສັງລວມ, ການວິເຄາະ, ການສ້າງເນື້ອໃນ, ສົນທະນາ RAGApache 2.0GPU ຂອງພວກເຮົາ
F5-TTSສຽງ​ແບບ​ຄລາສສິກ / ຂໍ້ຄວາມ​ເປັນ​ສຽງMITGPU ຂອງພວກເຮົາ
all-MiniLM-L6-v2ການ​ຝັງ​ການ​ຄົ້ນຫາ RAGApache 2.0GPU ຂອງພວກເຮົາ

ພວກເຮົາບໍ່ເອີ້ນ OpenAI, Anthropic, Google Cloud, ຫຼືພາກສ່ວນທີສາມໃດ LLM API ສໍາລັບຄຸນລັກສະນະໃດຫນຶ່ງ. ທຸກໆແບບທີ່ກ່າວມາຂ້າງເທິງແລ່ນຢູ່ໃນຮາດແວທີ່ພວກເຮົາມີແລະປະຕິບັດ. ການບໍລິການ AI ນອກດຽວທີ່ພວກເຮົາໃຊ້ແມ່ນ translateapi.ai (ຍັງ Muddy Holdings) ສໍາລັບການແປ UI ສາຍ - ນີ້ບໍ່ເຄີຍ touches ເນື້ອໃນ transcribed ຂອງທ່ານ.

ວິທີການເປີດເຜີຍ AI ພັນ

  • ແປ​ບົດ​ຄວາມ​ HTML: ລວມເອົາ <meta name=\
  • ສົ່ງອອກ​ຂໍ້ຄວາມ (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): ລວມເອົາ 'AI-generated transcript' ສາຍຫົວຢູ່ເທິງຂອງທຸກໆເອກະສານ.
  • ສຽງ​ສະສົມ / ຜົນ​ອອກ​ແບບ TTS: ໄຟລ WAV ລວມມີ​ແທັກ'synthetic-voice' ໃນ​ຂໍ້ມູນ​ເມຕາ ແລະ ແຈ້ງການ​ທີ່​ຈະ​ແຈ້ງ​ຢູ່​ໃນ​ໜ້າ​ດາວໂຫລດ. ຂໍ້​ຍົກເວັ້ນ​ສຽງ​ແມ່ນ​ຢູ່​ໃນ​ແຜນ​ທີ່​ທາງ​ເດີນ.
  • ການ​ຕອບ​ຮັບ API: ລວມເອົາ _ai_generated: ພື້ນທີ່​ຈິງ​ໃນ​ການ​ຕອບ​ໂຕ້ JSON ທຸກໆ​ຄັ້ງ​ທີ່​ມີ​ເນື້ອ​ໃນ​ທີ່​ໄດ້​ຖ່າຍ​ທອດ​ມາ​ແລ້ວ.

ຂໍ້ມູນ​ການ​ຝຶກ​ອົບຮົມ

  • ແບບແບບພື້ນຖານ (Whisper, MadLAD, Qwen, ອື່ນໆ) ຖືກຝຶກກ່ອນຈາກຜູ້ພິມອອກມາ. ພວກເຮົາໃຊ້ພວກມັນຕາມທີ່ສົ່ງມາ.
  • ບົດບັນທຶກຂອງທ່ານ ບໍ່ໄດ້ໃຊ້ເພື່ອຝຶກແບບແບບພື້ນຖານ.
  • ຖ້າ​ທ່ານ​ແກ້​ຂໍ້​ຜິດພາດ​ໃນ​ການ​ແປ​ຂໍ້​ຄວາມ (ຮູບ​ປ້າຍ​ພິມ) ຫຼື ​ເຮັດ​ໃຫ້​ມັນ​ຜິດ​ພາດ (ຮູບ​ປ້າຍ​ດອກ​ໄມ້), ແລະ​ທ່ານ​ໄດ້​ເລືອກ​ໃນ / privacy- settings / (\
  • ນອກນັ້ນ, ຕົວປ້ອນ ປະກອບສ່ວນ​ການ​ແກ້​ໄຂ​ເພີ່ມ​ເຕີມ​ສຽງ​ໄປ​ຍັງ​ຫ້ອງ​ທົດລອງ​ສຽງ (ຍັງ​ຢູ່​ທີ່ /privacy-settings/, ຖືກ​ປິດ​ຕາມ​ລຳ​ດັບ​ອີກ​ດ້ວຍ) ອະນຸຍາດ​ໃຫ້​ທ່ານ​ເລືອກ​ເອົາ​ການ​ປະກອບສ່ວນ​ສຽງ​ຂອງ​ສ່ວນ​ທີ່​ທ່ານ​ໄດ້​ແກ້​ໄຂ, ຄູ່​ກັບ​ຂໍ້​ຄວາມ​ທີ່​ໄດ້​ແກ້​ໄຂ, ໄປ​ຍັງ​ກຸ່ມ​ຂໍ້ມູນ​ຫ້ອງ​ທົດລອງ​ສຽງ​ຂອງພວກເຮົາ​ພາຍ​ໃຕ້​ CC-BY-SA-4.0. ຕົວປ້ອນ​ສອງ​ຢ່າງ​ແມ່ນ​ເປັນ​ເອກະ​ລາດ — ທ່ານ​ສາມາດ​ອະນຸຍາດ​ໃຫ້​ທັງ​ສອງ​ຢ່າງ ຫຼື ບໍ່​ອະນຸຍາດ​ໃຫ້​ທັງ​ສອງ​ຢ່າງ​ເລີຍ.
  • ສຽງທີ່ທ່ານອັບໂຫລດຈະຖືກລຶບອອກພາຍໃນ 24 ຊົ່ວໂມງຜ່ານ cleanup_ uploads cron - UNLESS ທ່ານໄດ້ເລືອກໃນ\

ຄວາມຖືກຕ້ອງ ແລະ ຄວາມຜິດພາດ

AI transcription ແມ່ນບໍ່ສົມບູນແບບ. ອັດຕາຄວາມຜິດພາດຄໍາແຕກຕ່າງກັນໂດຍສຽງເວົ້າ, ຄຸນນະພາບສຽງ, ພາສາ, ແລະຄໍາສັບຂອງໂດເມນ. ສໍາລັບການໃຊ້ງານສໍາຄັນ (ກົດຫມາຍ, ທາງການແພດ, ອຸດສາຫະກໍາທີ່ກໍານົດໄວ້) ກວດສອບຕໍ່ຕ້ານສຽງຕົ້ນສະບັບ. ມາດຕະຖານສາທາລະນະ WER ຂອງພວກເຮົາຕໍ່ແບບແມ່ນຢູ່ /models/.

ຄໍາຖາມ​ທີ່​ສອດຄ່ອງ

ສໍາລັບ EU AI Act, GDPR, ຫຼືຄໍາຖາມອື່ນໆທີ່ຖືກຕ້ອງ: hello@stt.ai ຫຼື​ໃຊ້ ແບບຟອມ​ຕິດຕໍ່.

ປັບປຸງ​ຫຼ້າສຸດ: 2026-04-26.