O Voxtral-Mini-4B-Realtime para transcrição de fala em tempo real agora está disponível no Amazon SageMaker JumpStart
Hoje, a AWS anunciou a disponibilidade do Ministral-3-4B-Instruct-2602 no Amazon SageMaker JumpStart, ampliando o portfólio de modelos de base disponíveis para os clientes da AWS. Esse modelo da Mistral AI é um modelo de transcrição de fala multilíngue e em tempo real, permitindo que os clientes criem aplicativos de fala de baixa latência na infraestrutura da AWS.
O Voxtral-Mini-4B-Realtime se destaca na transcrição de alta qualidade de áudio para texto com uma arquitetura de streaming nativa que permite a transcrição em tempo real. Ele suporta a transcrição multilíngue em 13 idiomas e oferece atrasos de transcrição configuráveis, permitindo que os usuários equilibrem a latência e a precisão com base em suas necessidades.
Com o SageMaker JumpStart, os clientes podem implantar esse modelo com apenas alguns cliques para abordar casos de uso de IA específicos. Para começar a usar esse modelo, navegue até a seção Modelos do SageMaker Studio ou use o SageMaker Python SDK para implantar os modelos em sua conta da AWS. Para obter mais informações sobre a implantação e o uso de modelos de base no SageMaker JumpStart, consulte a documentação do Amazon SageMaker JumpStart.