亚马逊AWS官方博客

OpenAI GPT-5.6 Sol、Terra 和 Luna 现已在 Amazon Bedrock 上正式推出

使用 OpenAI 迄今最智能的模型系列,在 Amazon Bedrock 的下一代推理引擎上进行构建。

正在扩展自主代理和 AI 驱动产品的组织需要能够在数百个步骤中可靠运行的前沿智能,从交付生产代码的编码代理,到探究新型攻击面的网络安全研究,再到端到端分析整个基因序列的基因组学工作流。这些工作负载运行在敏感数据上,需要在不可预测的负载下保持一致的吞吐量,并在数据驻留和安全性不容妥协的环境中运行。

今天,OpenAI 的 GPT-5.6 Sol、Terra 和 Luna 在 Amazon Bedrock 上正式推出,将 OpenAI 迄今最智能的模型系列引入 Amazon Bedrock 专为高性能、安全性和可靠性而打造的下一代推理引擎。GPT-5.6 为智能与效率树立了新标准,让您能在更短时间内以更高的每 Token 智能水平解决更复杂的问题。定价与 OpenAI 官方价格一致,用量计入您现有的 AWS 承诺用量。

从旗舰级推理到快速推理的前沿智能

GPT-5.6 引入了 OpenAI 的新命名系统:数字表示生成版本,而 Sol、Terra 和 Luna 则代表可持续能力等级,可按自身节奏持续提升。

• GPT-5.6 Sol 是 OpenAI 迄今为止的旗舰级推理模型,也是最强大的模型。根据 OpenAI 的数据,Sol 在人工分析编码代理索引(Artificial Analysis Coding Agent Index)上达到了新的前沿水平,得分为 80 分(比排名第二的模型高出 2.8 分),同时使用的输出 Token 不到一半,耗时不到一半,成本也低约三分之一。在 ExploitBench 网络安全研究测试中,其表现达到 73.5%,而 GPT-5.5 在相近的输出 Token 预算下仅取得 47.9% 的分数。在 Agents’ Last Exam 这项涵盖 55 个领域的长时间专业工作流评测中,Sol 以 53.6 分创下新高,领先次优模型 13.1 分。在中等推理强度下,它仍以 11.4 分的优势领先,且估计成本仅约为四分之一。 Sol 还引入了最大推理努力,让您为复杂工作调高计算量。使用 Sol 进行自主编码代理、漏洞研究、药物发现工作流程以及需要深入多步推理的任务。

• GPT-5.6 Terra 是适用于日常生产工作的均衡模型。 它以更低的成本提供优于 GPT-5.5 的性能。 将 Terra 用于代码生成、内容工作流、结构化数据提取,以及需要强大推理但无需旗舰级定价的通用智能体任务。

• GPT-5.6 Luna 是快速且经济实惠的模型。将 Luna 用于大批量推理任务,例如分类、摘要、路由,以及对延迟和每 Token 成本敏感的实时应用。

借助这三个层级,您可以针对每个工作负载合理调整模型能力和成本。GPT-5.6 模型完成任务所需的输出 Token 数量少于前代模型,从而以每美元更高的性价比提供更强的表现。

为规模化构建的推理引擎

智能体流量通常具有突发性:一个用户请求可能触发数百次模型调用,并且随着用量增长,需求可能快速变化。Amazon Bedrock 的下一代推理引擎能够集中资源以应对需求激增,同时确保每个客户的吞吐量独立。这减少了在共享容量和可预测的应用程序性能之间进行选择的需要。区域内推理将请求保持在您指定的 AWS 区域内,帮助团队满足严格的数据驻留要求。

智能体和多步工作负载也会在调用之间重复大量上下文。系统指令、工具定义和参考文件通常保持不变,只有最新的输入发生变化。Amazon Bedrock 上的 GPT-5.6 引入了具有显式缓存断点的提示缓存,以利用这种重复。您用缓存断点标记提示的可重用部分,Amazon Bedrock 将在共享该部分的后续请求中重用已处理的上下文,因此每次调用只需为新增工作付费。缓存输入按 90% 的折扣计费,并至少可重用 30 分钟。这段时间足够覆盖单次代理运行所产生的调用突发,而不会随着工作负载扩展而叠加成本。

坚固的安全性能与硬件强制性安全防护相结合

更强大的模型需要更强的保护措施。GPT-5.6 配备了 OpenAI 有史以来最完备的安全防护栈,经史上最长的评估周期锤炼而成,结合了人类红队测试和大规模自动化测试。安全栈包含模型层面对违禁内容的拒绝、实时滥用检测、持续监控,以及对长期异常行为的账户级管控。

在 Bedrock 上,这些防护叠加在硬件级安全之上。Amazon Bedrock 采用芯片级强制执行的零操作员访问(ZOA)模式,确保 AWS 运营人员无法接触您的提示和回复。每次模型调用都遵循您自己的 AWS Identity and Access Management(IAM)策略,在虚拟私有云(VPC)内完成,并同步记录于 CloudTrail。数据边界策略则阻止数据跨账户或跨网络泄漏。根据模型提供商的要求,被分类器标记的流量数据将保留最多 30 天,用于自动化滥用检测

在 Amazon Bedrock 上使用 GPT-5.6 的更多方式

在 GPT-5.6 之外,OpenAI 还推出了 ChatGPT Work,这是 ChatGPT 中用于处理更大型、多步骤任务的智能代理。 更新后的 Mac 和 Windows 版 ChatGPT 桌面应用将 Chat、Work 和 Codex 整合为统一体验,并提供两个针对不同工作类型的专用代理:

• Work: 全新的 Work 代理专为更大型、多步骤的任务而生。它能够跨应用和文件收集信息、使用网络、生成表格、幻灯片、文档和 Sites 等成品材料,并可长时间跟进复杂项目。用户可以跟踪其进度、调整方向,并对重要操作进行审批。

• Codex:Codex 仍然是面向开发人员和技术专业人士的强大编程代理。它可以处理本地文件、代码仓库、终端、开发工具和开发环境,从而编写功能、修复缺陷、运行测试和发起拉取请求。

用户可以通过 Amazon Bedrock 上的 Responses API 将应用配置为使用 GPT-5.6。在 Amazon Bedrock 上运行 OpenAI 最智能的模型系列,即可获得前沿智能,同时享有 AWS 的安全性和扩展能力。

立即开始使用

GPT-5.6 Sol 现已在以下 AWS 区域推出:美国东部(弗吉尼亚州北部)和美国东部(俄亥俄州)。GPT-5.6 Terra 和 Luna 已在美国东部(弗吉尼亚州北部)、美国东部(俄亥俄州)和美国西部(俄勒冈州)区域推出。

通过 Amazon Bedrock 控制台或借助 Responses API 以编程方式开始使用 Sol、Terra 和 Luna。如需了解更多信息,请参阅 Amazon Bedrock 文档并访问 Amazon Bedrock 产品页面

本篇作者

Tanvi Girinath

Tanvi 是 Amazon Web Services(AWS)Amazon Bedrock 的产品营销经理,她帮助客户利用 Amazon Bedrock 采用并扩展 AI 应用程序和代理。

Saurabh Trikande

Saurabh 是 Amazon Web Services(AWS)Amazon Bedrock 的高级产品经理。他主导的工作致力于让客户在任何规模下都能以高性能、安全且经济高效的方式,使用来自领先提供商的前沿模型进行推理。

Chris Dickens

Chris 是 OpenAI 的产品团队成员,专注于 OpenAI API。他的工作包括与 AWS 在 Amazon Bedrock 上进行合作,让开发人员能够广泛获取 OpenAI 的前沿模型。