Voxtral-Mini-4B-Realtime pour la transcription vocale en temps réel est désormais disponible dans Amazon SageMaker JumpStart
AWS a annoncé aujourd’hui la disponibilité de Voxtral-Mini-4B-Realtime-2602 dans Amazon SageMaker JumpStart, élargissant ainsi le portefeuille de modèles de fondation disponibles pour les clients AWS. Ce modèle de Mistral AI est un modèle de transcription vocale multilingue en temps réel, qui permet aux clients de créer des applications vocales à faible latence sur l’infrastructure AWS.
Voxtral-Mini-4B-Realtime excelle dans la transcription de haute qualité de l’audio en texte grâce à une architecture de diffusion native, qui permet une transcription en temps réel. Il prend en charge la transcription multilingue dans 13 langues et offre des délais de transcription configurables, permettant aux utilisateurs d’équilibrer latence et précision en fonction de leurs besoins.
Avec SageMaker JumpStart, les clients peuvent déployer ce modèle en quelques clics pour répondre à leurs cas d’utilisation spécifiques de l’IA. Pour commencer à utiliser ce modèle, accédez à la section Modèles de SageMaker Studio ou utilisez le kit SDK Python de SageMaker pour déployer le modèle sur votre compte AWS. Pour en savoir plus sur le déploiement et l’utilisation de modèles de base dans SageMaker JumpStart, consultez la documentation relative à Amazon SageMaker JumpStart.