Voxtral-Mini-4B-Realtime для транскрипции речи в реальном времени теперь доступен в Amazon SageMaker JumpStart

Проведено: 13 июля 2026 г.

Сегодня AWS объявляет о том, что модель Voxtral-Mini-4B-Realtime-2602 теперь доступна в Amazon SageMaker JumpStart, расширяя портфель базовых моделей, доступных клиентам AWS. Эта модель от Mistral AI представляет собой многоязычную модель транскрипции речи в реальном времени, позволяющую клиентам создавать речевые приложения с малой задержкой в инфраструктуре AWS.

Voxtral-Mini-4B-Realtime отлично справляется с высококачественной транскрипцией аудио в текст благодаря встроенной потоковой архитектуре, обеспечивающей транскрипцию в реальном времени. Она поддерживает многоязычную транскрипцию на 13 языках и предлагает настраиваемые задержки транскрипции, что позволяет пользователям балансировать задержку и точность в соответствии со своими потребностями.

Используя SageMaker JumpStart, клиенты могут развернуть эту модель всего несколькими щелчками мыши для своих примеров использования ИИ. Чтобы начать работу с этой моделью, перейдите в раздел «Модели» в Студии SageMaker или используйте SageMaker Python SDK для развертывания модели в своем аккаунте AWS. Подробные инструкции о развертывании и использовании базовых моделей в SageMaker JumpStart см. в документации Amazon SageMaker JumpStart.