O Amazon SageMaker AI Batch Transform agora oferece suporte a instâncias G6e
A Amazon SageMaker AI agora oferece suporte a instâncias G6e do Amazon EC2 para transformação em lote. O Batch Transform permite que você execute previsões em conjuntos de dados armazenados no Amazon S3 e é adequado para grandes conjuntos de dados que não exigem um endpoint de inferência persistente.
As instâncias G6e do Amazon EC2 são equipadas com até 48 GPUs NVIDIA L40S Tensor Core com 48 GB de memória por GPU e processadores AMD EPYC de terceira geração. As instâncias G6e oferecem melhor desempenho para workloads com uso intenso de GPU. Com esse lançamento, você pode usar instâncias G6e para workloads de inferência off-line com uso intenso de GPU, incluindo grandes modelos de linguagem e modelos de difusão que geram imagens, vídeo e áudio. Para começar a usar, selecione um tipo de instância ml.g6e compatível ao criar um trabalho de transformação em lote por meio dos SDKs da AWS, da CLI da AWS ou da API CreateTransformJob.
O suporte G6e para Batch Transform está disponível no Leste dos EUA (Norte da Virgínia), Leste dos EUA (Ohio), Oeste dos EUA (Oregon), Ásia-Pacífico (Mumbai) e Ásia-Pacífico (Hyderabad). Para saber mais, visite a página do produto Amazon SageMaker AI e consulte a documentação do Batch Transform. Para obter informações sobre os preços dessas instâncias, visite a nossa página de preços.