SageMaker AI 推理上的 G7e 实例实现区域扩展
发布于:
2026年7月23日
我们很高兴地宣布,Amazon EC2 G7e 实例现已在亚太地区(首尔)、欧洲地区(伦敦)和亚太地区(东京)的 Amazon SageMaker AI 推理上推出。G7e 实例配备最多 8 个 NVIDIA RTX PRO 6000 Blackwell 服务器版 GPU(每个 GPU 配备 96 GB 内存)、第 5 代英特尔至强处理器,以及高达 1,600 Gbps 的弹性结构适配器网络带宽,与上一代 G6e 实例相比,推理性能提升高达 2.3 倍。
通过此次区域扩展,您现在可以将推理端点部署在更靠近亚洲和欧洲终端用户的 G7e 实例上,从而降低生成式人工智能工作负载的延迟。G7e 实例在单个实例上提供高达 768 GB 的总 GPU 内存,使您无需多节点配置即可使用 FP8 精度服务参数规模高达 70B 的中大型语言模型。这些实例非常适合需要高 GPU 内存容量和带宽的 LLM 推理、图像和视频生成、空间计算以及科学计算工作负载。
除了之前受支持的区域外,用于 SageMaker AI 推理的 G7e 实例现已在亚太地区(首尔)、欧洲地区(伦敦)和亚太地区(东京)推出。有关这些实例的定价信息,请访问我们的定价页面。