AWS ParallelCluster 3.16 añade una herramienta de diagnóstico en el nodo

Publicado en: 24 de ago de 2026

AWS ParallelCluster 3.16 ya está disponible de forma general con una nueva herramienta de diagnóstico en los nodos, mejoras en la estabilidad de los clústeres y una pila de software HPC e IA y ML actualizada.

pcluster-diag es una herramienta de diagnóstico integrada en las AMI de ParallelCluster que le permite ejecutar comprobaciones de diagnóstico en cualquier nodo del clúster con un solo comando y obtener un informe estructurado que facilita la identificación de los problemas. Esta versión también refuerza el ciclo de vida de los clústeres con una creación, actualizaciones y creación de imágenes de clústeres más resilientes. La pila de software se actualiza con versiones actualizadas del controlador NVIDIA, CUDA, el instalador de EFA y Slurm. Para empezar a usar pcluster-diag, consulte Solución de problemas con pcluster-diag. Para obtener más información, consulte las notas de la versión 3.16.0 de AWS ParallelCluster.

AWS ParallelCluster es una herramienta de administración de clústeres de código abierto que permite a los clientes de I+D y a los administradores de las TI operar clústeres de computación de alto rendimiento (HPC) en AWS. ParallelCluster está diseñado para aprovisionar recursos en la nube de forma automática y segura en clústeres de HPC con escalado elástico, capaces de ejecutar cargas de trabajo científicas y de ingeniería a gran escala en AWS. ParallelCluster está disponible sin cargo adicional en las regiones de AWS que se enumeran aquí. Usted solo paga por los recursos de AWS que necesita para ejecutar sus aplicaciones.

Para obtener más información sobre la ejecución de clústeres de HPC en AWS, consulte la Guía del usuario de ParallelCluster. Para empezar a utilizar ParallelCluster, consulte las instrucciones de instalación de la interfaz de usuario y la CLI de ParallelCluster.