Voxtral-Mini-4B-Realtime để phiên âm giọng nói theo thời gian thực hiện có sẵn trong Amazon SageMaker JumpStart

Ngày đăng: 13 Th07 2026

Hôm nay, AWS thông báo cung cấp Voxtral-Mini-4B-Realtime-2602 trong Amazon SageMaker JumpStart, mở rộng danh mục mô hình nền tảng có sẵn cho khách hàng AWS. Mô hình này từ Mistral AI là mô hình phiên âm giọng nói theo thời gian thực đa ngôn ngữ, cho phép khách hàng xây dựng các ứng dụng giọng nói có độ trễ thấp trên cơ sở hạ tầng AWS.

Voxtral-Mini-4B-Realtime vượt trội về khả năng phiên âm âm thanh thành văn bản chất lượng cao với kiến trúc phát trực tuyến gốc, cho phép phiên âm theo thời gian thực. Mô hình này hỗ trợ phiên âm đa ngôn ngữ trên 13 ngôn ngữ và cung cấp độ trễ phiên âm có thể cấu hình, cho phép người dùng cân bằng độ trễ và độ chính xác dựa trên nhu cầu của họ.

Với SageMaker JumpStart, khách hàng có thể triển khai mô hình này chỉ với một vài cú nhấp chuột để giải quyết các trường hợp sử dụng AI cụ thể của họ. Để bắt đầu sử dụng mô hình này, hãy điều hướng đến phần Mô hình của Studio SageMaker hoặc sử dụng SageMaker Python SDK để triển khai mô hình vào tài khoản AWS của bạn. Để biết thêm thông tin về việc triển khai và sử dụng mô hình nền tảng trong SageMaker JumpStart, hãy xem tài liệu về Amazon SageMaker JumpStart.