STT.ai Enhanced
STT.ai ใช้โมเดลนี้ในระดับที่จ่ายเงิน มันเป็นโมเดลที่อยู่เบื้องหลัง STT.ai Enhanced การบันทึกฟรีใช้ Whisper Large v3 Turbo ซึ่งเร็วกว่า
ลองดูแผน →
·
เขียนฟรีด้วย Whisper Turbo →
4.2%
WER
99
ภาษา
15.9x
ความเร็ว
MIT
ใบอนุญาต
เกี่ยวกับ STT.ai Enhanced
STT.ai Enhanced เป็นโมเดลการแปลงเสียงเป็นข้อความที่แม่นยำที่สุดและเร็วที่สุดของเรา สร้างขึ้นบนสถาปัตยกรรมแปลงที่ทันสมัยที่สุดด้วยการปรับปรุงที่ถูกต้องตามกฎหมาย มันส่งมอบอัตราความผิดพลาดของคำที่นำหน้าในอุตสาหกรรม ผ่าน 100 ภาษา เหมาะสำหรับการแปลงเสียง, คำอธิบายแบบเรียลไทม์และแอพพลิเคชันระดับองค์กร
✦ เปิดใช้งานโมเดลที่เพิ่มคุณภาพ
เข้าถึงแบบจำลองที่แม่นยำที่สุดของเรา ด้วยแพ็คเกจที่จ่ายเงิน วิสเปอร์ ใหญ่-v3, ภาษา 99 และผู้พูด diarization
แสดงแผนการ →ข้อมูลรุ่น
- ตัวจัดหาOpenAI (hosted by STT.ai)
- สถาปัตยกรรม-
- ใบอนุญาตMIT
- ปรับปรุงใหม่Aug 2026
คำถามที่พบบ่อย
STT.ai Enhanced เป็นโมเดลการพูดเป็นข้อความ โดย OpenAI (hosted by STT.ai) STT.ai ทำงานบน GPU ของพวกเราเอง สำหรับบัญชีที่จ่ายค่าบริการ และมันเป็นโมเดลที่อยู่เบื้องหลัง STT.ai Enhanced tier การแปลภาษาฟรีใช้ Whisper Large v3 Turbo จุดตรวจสอบที่เร็วกว่าของครอบครัวเดียวกัน
ตามมาตรฐานการทดสอบ STT.ai Enhanced สามารถทำได้ราว 4.2% ของอัตราความผิดพลาดของคำ ความแม่นยำในโลกจริงขึ้นอยู่กับคุณภาพเสียง สำเนียง และภาษา สำหรับเสียงรบกวนหรือสำเนียงที่บันทึกไว้ ควรจะคาดหวังให้ WER สูงกว่า WER หลายเปอร์เซ็นต์
STT.ai Enhanced เป็นโมเดลที่ได้รับค่าคอมมิชชั่น — ถูกรวมเข้ากับแพลตฟอร์ม STT.ai ทุกแพลตฟอร์มที่จ่ายค่าบริการตั้งแต่ $9/เดือน มันไม่สามารถใช้ได้ในระดับฟรี: การอัปโหลดแบบฟรีและไม่ระบุชื่อจะใช้ Whisper Turbo แทน
STT.ai Enhanced ถูกปล่อยออกมาภายใต้ MIT ใบอนุญาตโอเพนซอร์สที่อนุญาตให้คุณสามารถใช้ STT.ai Enhanced บนฮาร์ดแวร์ของคุณเอง หรือใช้เวอร์ชั่นที่เราจัดเตรียมไว้ — ทั้งหมดนี้สามารถใช้ได้ในเชิงพาณิชย์
STT.ai Enhanced รองรับภาษา 99 ตัวตรวจจับอัตโนมัติจะเลือกภาษาที่ถูกต้องสำหรับเสียงส่วนใหญ่ คุณสามารถกำหนดเองได้ด้วยเพื่อเพิ่มความแม่นยำเล็กน้อย
STT.ai Enhanced ประมวลผลเสียงด้วยความเร็วประมาณ 15.9x ตามเวลาจริงบน GPU ของเรา แฟ้มเสียง 1 ชั่วโมง จะใช้เวลาไม่ถึง 3 นาที ส่วนแฟ้มที่ยาวกว่าจะถูกจัดเป็นคิวและแจ้งให้ทราบทางอีเมลเมื่อเสร็จสิ้น
STT.ai Enhanced มีพารามิเตอร์ 1.55B รุ่นที่ใหญ่กว่าจะมีแนวโน้มที่จะแม่นยำกว่า แต่ช้ากว่า; STT.ai ใช้ STT.ai Enhanced บน GPU ดังนั้น การนับพารามิเตอร์จะไม่ส่งผลต่อประสิทธิภาพด้านคลาวด์ของคุณ
STT.ai Enhanced รองรับทุกรูปแบบที่ STT.ai รองรับ — MP3, WAV, M4A, FLAC, OGG, MP4, MKV, MOV, WebM, AVI และอื่นๆ อีกมากมาย นำออกมาเป็น TXT, SRT, VTT, DOCX, JSON หรือ PDF
ใช่ การจัดเรียงผู้พูด ทำงานร่วมกับ STT.ai Enhanced สำหรับทุกการแปล ทุกคนที่พูดมีฉลาก และคุณสามารถเปลี่ยนชื่อพวกเขาในเครื่องมือแก้ไข
ใช่ STT.ai Enhanced ทำงานในโครงสร้างพื้นฐานส่วนตัวของเรา เสียงจะถูกประมวลผลและลบโดยปริยาย Pro + เพิ่มการเข้ารหัสด้านคลาวด์ ดังนั้นการแปลเป็นภาษาอังกฤษจะไม่สามารถอ่านได้โดยไม่มีกุญแจของคุณ และ Private Cloud ทำให้คุณสามารถโฮสต์ STT.ai Enhanced เองได้โดยสมบูรณ์ใน VPC ของคุณเอง
ใช้เครื่องมือ compare- stt เพื่อประมวลผล STT.ai Enhanced กับรุ่นอื่นที่รองรับบนเครื่องเสียงเดียวกัน คุณจะเห็น WER, จำนวนเซกเมนต์, แท็กลำโพง และคะแนนความเชื่อมั่น ติดกัน การเปรียบเทียบ STT.ai Enhanced กับ Whisper Large V3 นั้นเป็นวิธีที่ใช้กันมากที่สุด
ใช่ สำหรับแผนการจ่ายค่าบริการ ระบุ "stt-ai-enhanced" เป็นพารามิเตอร์แบบจำลองบนจุดจบ / v1/ transcribe กุญแจที่ไม่มีแผนการใช้งานจะถูกบริการด้วย Whisper Large v3 Turbo แทน การร้องขอยังคงสำเร็จ มันแค่ทำงานแบบจำลองฟรี
ใช่ เพราะ STT.ai Enhanced ได้รับอนุญาตจาก MIT คุณสามารถโฮสต์มันเองได้ หน้าโอเพนซอร์สของ STT.ai แสดงรายการโครงการและน้ำหนัก ทีมผลิตส่วนใหญ่ใช้เวอร์ชั่นโฮสต์ของเรา ข้ามการซื้อ GPU แบบจำลองสลับและปฏิบัติการ