亚马逊AWS官方博客

Amazon EC2!20 岁生日快乐!

二十年前的今天,Jeff Barr 写了一篇博客文章,推出了 Amazon EC2 测试版。那篇文章介绍了云中可调整大小的 Linux 虚拟服务器,按小时计费,在一个区域(美国东部)有一个实例类型(m1.small)。这虽然微不足道却很有用,改变了世界对计算基础设施的看法。

2021 年,Jeff 回顾了 EC2 十五年的发展历程,分享了背后的故事和那些令人难忘的 EC2 发布。在过去的五年中,AWS 一直在突破云计算所能提供的边界,为通用和人工智能工作负载构建定制硅芯片,并将 EC2 扩展到我们的客户在 2006 年无法想象的新外形规格和部署模型。

20 年历程简述
在他的 15 周年纪念文章中,Jeff 选择了 EC2 的重要里程碑,这些里程碑建立了客户今天仍然依赖的基础构建块。Amazon Elastic Block Store(2008)提供永久的块存储。弹性负载均衡、自动扩缩和 Amazon CloudWatch(2009)使应用程序具有可扩展性和高可用性。Amazon Virtual Private Cloud(2009)为客户提供逻辑隔离的网络。AWS Nitro System(2017)实现更快的创新并增强了安全性。AWS Graviton 处理器(2018)专为成本敏感的横向扩展工作负载而设计。

20 年来,EC2 从一种实例类型发展到超过 1200 种实例类型,可以满足通用、计算、内存和存储优化、加速计算和高性能计算系列的客户需求。这些实例从一个 AWS 区域扩展到全球 39 个区域。AWS 还将 EC2 扩展到了区域边界以外,AWS Outposts(2018)在本地运行 EC2 实例,AWS Local Zones(2019)在全球范围内运行,AWS Wavelength(2019)在全球 5G 电信运营商网络中运行。

虽然我讨厌厚此薄彼,但我还是想选出过去五年中我最喜欢的一些 EC2 发布:

  • 用于大规模机器学习推理的 AWS Inferentia(2019):我们推出了采用 AWS Inferentia 硅芯片、专门构建的机器学习推理实例(inf1)。Amazon EC2 Inf2 实例于 2023 年 4 月正式推出,适用于大规模生成式人工智能推理工作负载。与 Inferentia 系列一起,AWS Trainium 实例现在为客户提供了一整套 AWS 设计的硅芯片,这些硅芯片针对人工智能生命周期的每个阶段(包括推理和训练)进行了优化。
  • EC2 Mac 实例 (2020):首批 Mac 实例(mac1)基于搭载 Intel Core i7(Coffee Lake)的 Apple Mac mini 构建,以 AWS Nitro System 为基础。Mac M1(mac2)实例于 2022 年 7 月发布,是 EC2 上首个基于 ARM 的 macOS 实例。紧随其后,2003 年发布 M2 Pro Mac 实例,2025 年发布 M4 和 M4 Pro Mac 实例,2026 年发布 M3 Ultra Mac 实例M4 Max Mac 实例,为 Apple 开发人员提供了一整套适用于 macOS、iOS、iPadOS、tvOS、watchOS 和 visionOS 应用程序,基于云的构建和测试环境。
  • 适用于大规模全栈人工智能工作负载的 AWS Trainium(2021)2021 年 11 月,我们推出了 Trn1 实例的预览版,该实例采用针对高性能深度学习训练进行了优化的 AWS Trainium 加速器。2024 年 12 月,发布由 AWS Trainium2 提供支持的 Trn2 实例Trn2 UltraServers 通过 NeuronLink 链接了 64 个 Trainium2 加速器,用于训练具有万亿个参数的基础模型。在 AWS re:Invent 2025 上,由 AWS Trainium3 提供支持的 Trn3 UltraServers 为下一代代理、推理和视频生成应用程序提供最佳的令牌经济效益。单个 Trn3 UltraServer 可互连多达 144 个 Trainium3 硅芯片,用于训练和服务最大的前沿模型。现在,AWS Trainium3 为大规模高性能人工智能训练和推理提供领先的性价比。
  • 适用于 ML 的 EC2 容量块(2023):这种新的 EC2 使用模式让用户可以轻松访问 GPU 实例来训练和部署机器学习和生成式人工智能模型,从而进一步普及机器学习。您可以预留需要的 GPU 容量(最初为 P5 实例)以备将来使用,且仅按所需的持续时间预留。 2024 年 11 月,适用于 ML 的 EC2 容量块增加了对在几分钟内进行预置的支持,预置时间最长可延长至六个月。现在,除了 P5 之外,适用于 ML 的 EC2 容量块还支持 P6-B300P6-B200P5eP5enP4dP4de、Trn1、Trn2 和 Trn3 实例。
  • AWS Graviton5(2025):在自 2018 年以来八年的 Graviton 创新基础上,我们在 AWS re:Invent 2025 上推出了 Graviton5 硅芯片的预览版,并发布了由 Graviton5 提供支持、基于第六代 AWS Nitro System 的 M9g 和 M9gd 实例。紧随其后,2026 年 6 月发布了 C9g 和 C9gd。现在,Graviton5 拥有 192 个内核、大了 5 倍的缓存以及最多减少 33% 的内核间延迟,使其非常适合代理式人工智能工作负载不断增长的需求,例如实时推理、代码生成和多步任务编排,这些工作负载需要持续的高吞吐量 CPU 大规模计算。
  • AWS Nitro Isolation Engine(2026):客户不只是想听我们怎么说,更想亲眼看到 Nitro 虚拟机监控器在工作负载隔离方面的实际证据。Nitro Isolation Engine 是 Nitro 虚拟机监控器内部专门构建的组件,利用形式验证为客户工作负载相互隔离和 AWS 运营商提供数学保证,为经过数学验证的云安全性开创了新标准。该功能还基于第六代 AWS Nitro System,该系统自 2017 年推出以来一直在不断发展。

这一切背后的基础
尽管进行了二十年的创新,但 Amazon EC2 的基础价值主张并未改变。客户使用该服务在几分钟内获得安全、可调整的计算容量,仅按实际用量付费,无需长期承诺即可按需扩展。现在,同样的灵活性扩展到人工智能工作负载,其规模之大,在 2006 年是无人能预见的。

EC2 仍然是 AWS 的基础计算层。Amazon ECSAmazon EKSAWS LambdaAWS FargateAWS BatchAmazon EMRAmazon SageMaker AIAmazon Bedrock 最终使用 EC2 容量运行。客户在过去二十年中构建的每种架构模式,从简单的 Web 服务器到具有万亿参数的基础模型训练集群,都始于发布实例的决策。

我们在 2006 年做出了强有力的基础决策,为服务的发展留出了空间。二十年后,创建最低限度但有用的服务、快速发布以及根据您的反馈快速迭代的策略,继续指导着我们的构建方式。未来二十年的云计算需要我们现在还无法预想的能力。Amazon EC2 将继续作为您的工作负载运行的基础。

要了解有关 Amazon EC2 的更多信息,请访问 Amazon EC2 产品页面或查看 EC2 的新增功能

Channy