Voxtral-Mini-4B-Realtime สำหรับการถอดเสียงพูดแบบเรียลไทม์ พร้อมใช้งานแล้วใน Amazon SageMaker JumpStart

โพสต์บน: 13 ก.ค. 2026

วันนี้ AWS ได้ประกาศให้ Voxtral-Mini-4B-Realtime-2602 พร้อมใช้งานใน Amazon SageMaker JumpStart แล้ว ซึ่งช่วยขยายพอร์ตโฟลิโอของโมเดลพื้นฐานที่พร้อมให้บริการแก่ลูกค้า AWS โมเดลจาก Mistral AI นี้เป็นโมเดลการถอดเสียงพูดแบบหลายภาษาสำหรับการใช้งานแบบเรียลไทม์ ช่วยให้ลูกค้าสามารถสร้างแอปพลิเคชันด้านเสียงที่มีเวลาแฝงต่ำบนโครงสร้างพื้นฐานของ AWS

Voxtral-Mini-4B-Realtime โดดเด่นด้านการถอดเสียงจากเสียงเป็นข้อความด้วยคุณภาพสูง โดยใช้สถาปัตยกรรมการสตรีมโดยกำเนิดที่รองรับการถอดเสียงแบบเรียลไทม์ โมเดลนี้รองรับการถอดเสียงหลายภาษาใน 13 ภาษา และมีตัวเลือกในการกำหนดค่าความล่าช้าในการถอดเสียง ทำให้ผู้ใช้สามารถปรับสมดุลระหว่างเวลาแฝงและความแม่นยำได้ตามความต้องการ

ด้วย SageMaker JumpStart จะทำให้ลูกค้าสามารถติดตั้งใช้งานโมเดลนี้ได้ด้วยการคลิกเพียงไม่กี่ครั้ง เพื่อรองรับกรณีการใช้งาน AI เฉพาะของตน ในการเริ่มต้นใช้งานโมเดลนี้ ให้ไปที่ส่วน Models ของ SageMaker Studio หรือใช้ SageMaker Python SDK เพื่อติดตั้งใช้งานโมเดลไปยังบัญชี AWS ของคุณ ดูข้อมูลเพิ่มเติมเกี่ยวกับการติดตั้งใช้งานและการใช้โมเดลพื้นฐานบน SageMaker JumpStart ได้ที่เอกสารประกอบของ Amazon SageMaker JumpStart