นโยบายและความโปร่งใสของ AI
อะไรคือ AI ที่เราใช้ มันทำงานที่ไหน และเราจะปฏิบัติตามข้อกำหนดการเปิดเผยอย่างไร (EU AI Act บทที่ 50, ใช้ได้ 2026-08-02)
ดอร์
- ทุกๆการแปลเป็น AI ทุกๆการออกแบบ นำเสนอการเปิดเผยที่อ่านได้ด้วยเครื่อง
- ทุก AI ทำงานบน GPU ของพวกเราเอง เราไม่ส่งเสียงหรือข้อความของคุณไปยัง OpenAI, Anthropic, Google หรือ API ของ LLM ส่วนที่สาม
- เราไม่ฝึกโมเดลใดๆ บนแผ่นเสียงของคุณ ทุกๆ โมเดลที่เราใช้ เป็นโมเดล Open Source แบบเต็มรูปแบบ คำแก้ไขที่คุณทำจะถูกเก็บไว้ ถ้าคุณเลือกใช้
- เสียงที่ถูกโคลน (TTS) ถูกระบุอย่างชัดเจนว่าเป็นเสียงที่สร้างขึ้นโดย AI ในชื่อแฟ้ม ข้อมูลส่วนตัว และบนหน้าเว็บ
แบบจำลองที่เราใช้
| รุ่น | ใช้สำหรับ | ใบอนุญาต | กำลังทำงานอยู่ |
|---|---|---|---|
| Whisper large-v3-turbo (faster-whisper) | ตัวอักษร | MIT | หน่วยประมวลผลภาพจิ๋วของเรา |
| Whisper large-v3 (faster-whisper) — branded “STT.ai Enhanced” | เขียนทับ (แพ็คเกจจ่ายเงิน) | MIT | หน่วยประมวลผลภาพจิ๋วของเรา |
| Vosk | กระแสคำแบบเรียลไทม์ | Apache 2.0 | หน่วยประมวลผลภาพจิ๋วของเรา |
| SpeechBrain ECAPA-TDNN | ปรับแต่งการแสดงผล | Apache 2.0 | หน่วยประมวลผลภาพจิ๋วของเรา |
| MadLAD-400 3B | การแปลภาษา (ภาษา 450+) | Apache 2.0 | หน่วยประมวลผลภาพจิ๋วของเรา |
| Qwen2.5-1.5B (llama.cpp) | รายงานสรุป การวิเคราะห์ การสร้างเนื้อหา การสนทนา RAG | Apache 2.0 | หน่วยประมวลผลภาพจิ๋วของเรา |
| F5-TTS | สร้างเสียงคู่ / ข้อความเป็นเสียง | MIT | หน่วยประมวลผลภาพจิ๋วของเรา |
| all-MiniLM-L6-v2 | ตัวบรรจุสำหรับค้นหา RAGName | Apache 2.0 | หน่วยประมวลผลภาพจิ๋วของเรา |
"STT.ai Enhanced" คือชื่อผลิตภัณฑ์ของเราสำหรับ Whisper large- v3 ทำงานบน GPU ของพวกเรา มันไม่ใช่โมเดลที่กำหนดเอง ปรับแต่งหรือค่าน้ำหนักที่ถูกต้องตามกฎหมาย - มันเป็นจุดตรวจสอบ Whisper ที่มีขนาดใหญ่และมีความแม่นยำที่สุด มันมีความแม่นยำมากกว่า Whisper large- v3- turbo แบบปริยาย และช้ากว่าประมาณ 1.5x ในงานที่ถูกจัดทำเป็นวัน วัดบนฮาร์ดแวร์ของเราเอง
เราไม่เรียก OpenAI, Anthropic, Google Cloud, หรือ API ของ LLM ของบุคคลที่สามใดๆ สำหรับฟังก์ชันใดๆ ทุกตัวอย่างที่กล่าวมาข้างต้นทำงานบนฮาร์ดแวร์ที่เรามีและใช้บริการ บริการ AI ภายนอกเดียวที่เราใช้คือ translateapi. ai (รวมถึง Muddy Holdings) สำหรับการแปลข้อความ UI - นี่ไม่เคยสัมผัสเนื้อหาที่คุณบันทึกไว้
เราเปิดเผย AI รุ่นใหม่ได้อย่างไร
- เขียนหน้า HTML ออกมา: ชื่อผู้ใช้
- การส่งออกข้อความ (TXT, SRT, VTT, JSON, CSV, DOCX, PDF): เพิ่มบรรทัดหัวข้อ 'AI- generated transcript' ไว้ด้านบนของแฟ้มทุกแฟ้ม
- ข้อมูลออกมาเป็นเสียงสังเคราะห์ / TTS: แฟ้ม WAV ประกอบด้วยแท็ก 'เสียงสังเคราะห์' ในข้อมูลเมตา และข้อความแจ้งเตือนที่ชัดเจนบนหน้าดาวน์โหลด ข้อยกเว้นการรับผิดชอบทางเสียงอยู่ในแผนภูมิ
- การตอบสนอง API: เพิ่มช่องข้อมูล _ai_generated: true เข้าไปในการตอบรับ JSON ทุกครั้งที่มีเนื้อหาที่ถูกแปลเป็นภาษาอื่น
ข้อมูลการฝึก
- โมเดลพื้นฐาน (Whisper, MadLAD, Qwen, ฯลฯ) มาพร้อมการฝึกฝนจากผู้พิมพ์ของเรา เราใช้มันตามที่ส่งมา
- ข้อมูลของคุณไม่ได้ใช้ในการฝึก โมเดลพื้นฐาน
- หากคุณแก้ไขส่วนของการตีความ (ไอคอนปากกา) หรือ ทำการสแกนว่ามันไม่ถูกต้อง (ไอคอนธง) และคุณได้เลือกที่ / privacy- settings / (เปิด/ ปิดการใช้งาน "การฝึกแบบจำลอง") คู่ (ข้อความที่ไม่ถูกต้อง → ข้อความที่ถูกแก้ไข) จะถูกเก็บไว้เพื่อฝึกโมเดลการแก้ไขข้อความในอนาคต มีเพียงคู่ข้อความเท่านั้น - ไม่มีเสียงรอบๆ - ที่ใช้กับพาธนี้ ไม่มีโมเดลแบบนี้ในปัจจุบัน: คู่คำจะถูกเก็บไว้และไม่มีอะไรที่เราให้บริการในปัจจุบันที่ได้รับการฝึกบนมัน
- ตัวเลือก Contribute corrections plus audio to Voice Lab (ยังอยู่ใน / privacy- settings /, ยังปิดปริยาย) เลือกให้คุณสามารถส่งเสียงของส่วนที่คุณแก้ไขไปยัง Voice Lab ภายใต้ CC- BY- SA- 4.0 ได้ โดยตัวเลือกทั้งสองตัวนี้จะทำงานแยกกัน — คุณสามารถเลือกให้ใช้ทั้งสองตัวหรือไม่ใช้ทั้งสองตัว
- เพลงที่คุณอัพโหลดจะถูกลบออกภายใน 24 ชั่วโมง โดยใช้คอนแรม cleanup_ uploads - เว้นแต่คุณเลือกให้ใช้
ความถูกต้องและข้อผิดพลาด
การแปลภาษาด้วย AI นั้นไม่สมบูรณ์แบบ อัตราความผิดพลาดของคำอาจแตกต่างกันไปตามสำเนียงของผู้พูด คุณภาพเสียง ภาษา และอารมณ์ของคำ สำหรับการใช้ที่สำคัญ (กฎหมาย ทางการแพทย์ อุตสาหกรรมที่ถูกกำหนด) โปรดตรวจสอบกับเสียงต้นฉบับ ค่าเบนซ์ WER สำหรับแต่ละโมเดลอยู่ที่ /models/.
คำถามเกี่ยวกับความปลอดภัย
สำหรับกฎหมาย AI ของ EU, GDPR หรือคำถามอื่นๆที่เกี่ยวข้องกับการปฏิบัติตาม hello@stt.ai หรือใช้ รูปแบบการติดต่อ.
ปรับปรุงล่าสุด: 2026-08-05.