SageMaker AI 推理上的 G6 实例实现区域扩展

发布于: 2026年7月23日

我们很高兴地宣布,Amazon EC2 G6 实例现已在 AWS GovCloud(美国东部)区域的 Amazon SageMaker AI 推理上推出。G6 实例搭载最多 8 个 NVIDIA L4 Tensor Core GPU(每个 GPU 配备 24 GB 内存)和第三代 AMD EPYC 处理器,与 G4dn 实例相比,深度学习推理性能最多提升 2 倍。

通过此次区域扩展,政府机构和在 GovCloud 中运营的组织可以在 G6 实例上部署推理端点,以服务生成式人工智能工作负载,包括中小型语言模型、图像生成和计算机视觉任务,同时满足严格的合规性和数据驻留要求。G6 实例为适合 24 GB GPU 内存范围内的生产推理工作负载提供出色的性价比。

除了之前受支持的区域,用于 SageMaker AI 推理的 G6 实例现已在 AWS GovCloud(美国东部)区域推出。有关这些实例的定价信息,请访问我们的定价页面