La trasformazione in batch di Amazon SageMaker AI ora supporta le istanze G6e
Amazon SageMaker AI ora supporta le istanze Amazon EC2 G6e per i processi di trasformazione in batch. La trasformazione in batch consente di eseguire previsioni su set di dati archiviati in Amazon S3 ed è indicata per set di dati di grandi dimensioni che non richiedono un endpoint di inferenza persistente.
Le istanze Amazon EC2 G6e sono dotate di un massimo di otto GPU NVIDIA L40S Tensor Core, ciascuna con 48 GB di memoria, e di processori AMD EPYC di terza generazione. Le istanze G6e offrono prestazioni migliori per i carichi di lavoro a elevato utilizzo di GPU. Con questa novità, è possibile utilizzare le istanze G6e per i carichi di lavoro di inferenza offline a elevato utilizzo di GPU, inclusi modelli linguistici di grandi dimensioni e modelli di diffusione per la generazione di immagini, video e audio. Per iniziare, seleziona un tipo di istanza ml.g6e supportato quando crei un processo di trasformazione in batch tramite gli SDK AWS, AWS CLI o l'API CreateTransformJob.
Il supporto per le istanze G6e nella trasformazione in batch è disponibile nelle regioni AWS Stati Uniti orientali (Virginia settentrionale), Stati Uniti orientali (Ohio), Stati Uniti occidentali (Oregon), Asia Pacifico (Mumbai) e Asia Pacifico (Hyderabad). Per ulteriori informazioni, visita la pagina del prodotto Amazon SageMaker AI e consulta la documentazione della trasformazione in batch. Per informazioni sui prezzi di queste istanze, consulta la nostra pagina dei prezzi.