AWS 人工智能工厂
AWS 自建人工智能基础设施。可部署于您自有数据中心并直接投入使用。快速完成部署。
部署于您数据中心内的全托管人工智能基础设施
您提供数据中心和电力,我们将为您部署一套专用、安全且完全托管的人工智能基础设施。借助近二十年的 AWS 云专业知识,人工智能工厂可帮助您省去数年的构建工作和维护成本。
为安全与主权人工智能而构建
借助专为您构建的专用部署,满足数据主权和安全要求。您可以根据专有数据训练和运行大型模型,同时满足对数据处理和存储位置的严格监管要求。
创新并扩展人工智能工作负载
使用 Amazon EC2、Bedrock 和 Amazon SageMaker 等服务进行创新,同时由 AWS 部署和运营底层基础设施,包括最新的人工智能芯片(如 Trainium 加速器和 NVIDIA GPU)、网络和存储。
功能
大规模部署最新人工智能芯片
在由最新 Trainium 加速器(包括 Trainium2 和 Trainium3)以及 NVIDIA GPU(包括 B200、GB200 以及即将推出的 B300、GB300)加速的 EC2 实例上运行要求严苛的人工智能工作负载,为大规模训练和推理提供最高的 GPU 性能。
PB 级网络架构
在 PB 级的无阻塞网络中部署通过 Elastic Fabric Adapter(EFA)网络互连的 EC2 UltraClusters,帮助您扩展至数千个 GPU,并访问每秒百亿亿次(exaflops)级别的加速计算能力。
高性能存储
使用适用于 Lustre 的 Amazon FSx 和 Amazon S3 Express One Zone 存储类,您可以以数百 GB/秒的吞吐量和数百万 IOPS 访问数据,满足大规模人工智能模型训练和推理工作负载的需求。
企业人工智能服务与模型
使用专门的人工智能服务(包括 Amazon Bedrock 和 Amazon SageMaker)利用您的专有数据构建人工智能应用程序,以访问领先的基础模型,并构建、训练和部署您自己的人工智能模型。
利用现有投资
利用您已投资的数据中心空间和电力,无论您处于人工智能旅程的哪个阶段,都能满足您的需求。
增强的安全性与稳定性
使用 AWS Nitro System 的硬件和固件保护敏感工作负载,这些硬件和固件专为强制执行限制而设计,确保包括 AWS 在内的任何人都无法访问您的敏感人工智能工作负载。Nitro System 可在保持运行的同时部署固件更新和错误修复,并提高稳定性。
使用案例
加速人工智能驱动的应用程序
使用 Amazon SageMaker 和 Bedrock 部署人工智能推理应用程序。AWS 提供专门的网络、高性能存储和全面的人工智能服务,将您的基础设施转变为人工智能环境。
主权人工智能计算
通过专用环境满足数据主权和合规性要求,使受监管行业和政府能够在遵守安全需求的同时利用人工智能的力量并推动经济发展。
训练前沿人工智能模型
AWS 人工智能工厂提供专门的计算基础设施,用于训练各种规模的先进人工智能模型。借助 NVIDIA GPU 和 UltraCluster,处理海量数据集以构建能够快速处理复杂任务的模型,从而最大限度地提高大规模训练性能。
AWS 人工智能工厂的最新动态
- [最新文章] 推出 AWS 人工智能工厂
- [博客] 新的 AWS 人工智能工厂将客户的现有基础设施转变为高性能人工智能环境