Voxtral-Mini-4B-Realtime untuk transkripsi ucapan waktu nyata kini tersedia di Amazon SageMaker JumpStart

Dikirim di: 13 Jul 2026

Hari ini, AWS mengumumkan ketersediaan Voxtral-Mini-4B-Realtime-2602 di Amazon SageMaker JumpStart, memperluas portofolio model dasar yang tersedia bagi pelanggan AWS. Model dari Mistral AI ini adalah model transkripsi ucapan multibahasa dan real-time, yang memungkinkan pelanggan untuk membangun aplikasi ucapan dengan latensi rendah pada infrastruktur AWS.

Voxtral-Mini-4B-Realtime unggul dalam transkripsi audio ke teks berkualitas tinggi dengan arsitektur streaming asli yang memungkinkan transkripsi secara real-time. Perangkat lunak ini mendukung transkripsi multibahasa dalam 13 bahasa dan menawarkan penundaan transkripsi yang dapat dikonfigurasi, memungkinkan pengguna untuk menyeimbangkan latensi dan akurasi sesuai kebutuhan mereka.

Dengan SageMaker JumpStart, pelanggan dapat menerapkan model ini hanya dengan beberapa klik untuk mengatasi kasus penggunaan AI spesifik mereka. Untuk memulai menggunakan model ini, buka bagian Model di SageMaker Studio atau gunakan SageMaker Python SDK untuk menyebarkan model ke akun AWS Anda. Untuk informasi selengkapnya tentang men-deploy dan penggunaan model fondasi di SageMaker JumpStart, lihat dokumentasi Amazon SageMaker JumpStart.