AWS ParallelCluster 3.16 ajoute un outil de diagnostic sur les nœuds

Publié le: 24 août 2026

AWS ParallelCluster 3.16 est désormais disponible pour tous avec un nouvel outil de diagnostic sur les nœuds, des améliorations de la stabilité du cluster et une pile logicielle HPC et IA/ML mise à jour.

pcluster-diag est un outil de diagnostic intégré aux AMI de ParallelCluster, qui vous permet d’exécuter des vérifications de diagnostic sur n’importe quel nœud de cluster à l’aide d’une seule commande et d’obtenir un rapport structuré qui facilite l’identification des problèmes. Cette version renforce également le cycle de vie des clusters grâce à une création de cluster, des mises à jour et des créations d’images plus résilientes. La pile logicielle est actualisée, avec les versions mises à jour du pilote NVIDIA, de CUDA, du programme d’installation EFA et de Slurm. Pour commencer à utiliser pcluster-diag, consultez la section Résolution des problèmes liés à pcluster-diag. Pour en savoir plus, consultez les notes de mise à jour d’AWS ParallelCluster 3.16.0

AWS ParallelCluster est un outil de gestion de clusters open source qui permet aux clients R&D et aux administrateurs informatiques d’exploiter des clusters de calcul haute performance (HPC) sur AWS. ParallelCluster est conçu pour provisionner automatiquement et en toute sécurité des ressources cloud dans des clusters HPC évolutifs capables d'exécuter des charges de travail scientifiques et d'ingénierie à grande échelle sur AWS. ParallelCluster est disponible sans frais supplémentaires dans les Régions AWS listées ici, et vous ne payez que pour les ressources AWS nécessaires à l’exécution de vos applications.

Pour en savoir plus sur le lancement de clusters HPC sur AWS, consultez le Guide de l’utilisateur de ParallelCluster. Pour commencer à utiliser ParallelCluster, consultez les instructions d’installation de l’interface utilisateur et de la CLI de ParallelCluster.