AWS ParallelCluster 3.16 เพิ่มเครื่องมือวินิจฉัยบนโหนด
ขณะนี้ AWS ParallelCluster 3.16 พร้อมใช้งานทั่วไปพร้อมเครื่องมือวินิจฉัยบนโหนดใหม่, การปรับปรุงความเสถียรของคลัสเตอร์ และสแต็กซอฟต์แวร์ HPC และ AI/ML ที่อัปเดตแล้ว
pcluster-diag เป็นเครื่องมือวินิจฉัยที่มีอยู่ใน ParallelCluster AMI ซึ่งช่วยให้คุณเรียกใช้การตรวจสอบเพื่อวินิจฉัยบนโหนดใดๆ ของคลัสเตอร์ได้ด้วยคำสั่งเดียว และรับรายงานที่มีโครงสร้างซึ่งช่วยให้ระบุปัญหาได้ง่ายขึ้น รุ่นนี้ยังเสริมความแข็งแกร่งให้กับวงจรชีวิตของคลัสเตอร์ด้วยการสร้างคลัสเตอร์ การอัปเดต และการสร้างอิมเมจที่มีความทนทานมากขึ้น สแต็กซอฟต์แวร์ได้รับการปรับปรุงใหม่ด้วยไดรเวอร์ NVIDIA, CUDA, ตัวติดตั้ง EFA และ Slurm เวอร์ชันที่อัปเดตแล้ว ในการเริ่มต้นใช้งาน pcluster-diag โปรดดูการแก้ไขปัญหาด้วย pcluster-diag สำหรับรายละเอียดเพิ่มเติม โปรดดูบันทึกย่อประจำรุ่นของ AWS ParallelCluster 3.16.0
AWS ParallelCluster เป็นเครื่องมือจัดการคลัสเตอร์แบบโอเพนซอร์สที่ทำให้ลูกค้าฝ่าย R&D (วิจัยและพัฒนา) และผู้ดูแลระบบ IT สามารถดำเนินการคลัสเตอร์การประมวลผลสมรรถนะสูง (HPC) บน AWS ได้ ParallelCluster ได้รับการออกแบบมาเพื่อจัดเตรียมทรัพยากรระบบคลาวด์โดยอัตโนมัติและปลอดภัยให้กับคลัสเตอร์ HPC ที่ปรับขนาดได้อย่างยืดหยุ่น ซึ่งสามารถเรียกใช้เวิร์กโหลดทางวิทยาศาสตร์และวิศวกรรมได้หลายแบบบน AWS ParallelCluster พร้อมให้บริการโดยไม่มีค่าใช้จ่ายเพิ่มเติมใน AWS Region ที่ระบุไว้ที่นี่ และคุณจะชำระค่าบริการเฉพาะสำหรับทรัพยากร AWS ที่จำเป็นต่อการเรียกใช้แอปพลิเคชันของคุณเท่านั้น
เรียนรู้เพิ่มเติมเกี่ยวกับการเปิดใช้คลัสเตอร์ HPC บน AWS ได้ที่คู่มือผู้ใช้ ParallelCluster หากต้องการเริ่มใช้ ParallelCluster โปรดดูคำแนะนำในการติดตั้งสำหรับ UI และ CLI ของ ParallelCluster