亚马逊AWS官方博客

借助 Amazon Bedrock 上的 GPT-6.1 Sol 为日常工作带来接近 Astra 水平的智能能力

GPT-6.1 Sol 现已在 Amazon Bedrock 上正式可用,为编程、计算机操作以及频繁运行的专业工作负载带来更强的推理能力。

为了完成任务,AI 智能体可能需要收集信息、使用工具、尝试不同方法、从错误中恢复,并验证结果。每个决策都会影响后续步骤。一次错误判断,就可能增加智能体获得有用结果之前所需的模型交互、工具调用和人工干预,并带来额外延迟。

AI 智能体的成本效益需要从整个任务过程来衡量。Token 价格影响每次交互的成本,而推理质量则影响完成工作所需的交互次数,以及这些交互能否带来成功的结果。完成一项任务的总成本取决于这两个因素。

即日起,GPT-6.1 Sol 在 Amazon Bedrock 上正式可用。该模型所依托的推理引擎专为满足大规模应用对性能、安全性和可靠性的要求而构建。作为 GPT-6 Sol 的重大升级版本,它在智能体编程、计算机操作和专业工作方面表现出色。据 OpenAI 介绍,它能为日常工作流提供接近 Astra 水平的智能能力。

将更强的推理能力应用于智能体任务

1. 更有效地推进软件工程工作流

软件工程可以体现推理质量如何影响整个工作流。智能体可能需要理解一个不熟悉的代码库、追踪依赖关系、确定应在何处进行修改,并验证实现结果。据 OpenAI 介绍,GPT-6.1 Sol 在 DeepSWE v1.1 上的表现与 GPT-6 Astra 持平,而单任务成本约为后者的五分之一。同时,GPT-6.1 Sol 的得分比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点,且所用的推理强度低于后者取得该成绩时的水平。

Codex 将这些推理能力应用于整个开发周期。您可以将 Codex 配置为通过 Amazon Bedrock 使用 GPT-6.1 Sol,完成分析、实现和测试等各阶段的工作。Codex 可结合代码库、本地文件、终端和开发工具,实现功能、修复缺陷并运行测试。您可以通过桌面应用、CLI 和受支持的 IDE 使用 Codex。在 AWS 开发场景中,借助 Agent Toolkit for AWS,您只需一条终端命令,即可将 Codex 连接至 AWS 文档、API 和服务。

2. 跨文档和工具将信息转化为行动

当智能体需要解读复杂文档、选择合适的工具,并随条件变化作出调整时,同样可以发挥这些推理能力。据 OpenAI 介绍,GPT-6.1 Sol 在复杂文档分析方面的表现接近 GPT-6 Astra,且在跨业务工具完成多步骤工作流时,表现优于 GPT-6 Sol。

您可以通过开箱即用的产品或自行构建的应用来使用这些能力。在桌面应用中,ChatGPT Work 能够从文件和应用中收集信息,并将其转化为完整的交付成果。您也可以通过受支持的 Amazon Bedrock API,构建综合整理文档内容的内部工具、跨系统协调工作的智能体,以及面向客户、能够评估多项输入信息的应用。

3. 识别局限并遵守约束

要有效地协同使用多种工具,智能体还需要识别工具调用失败、操作受限或信息缺失等情况。说明这些局限,可以让应用或用户在智能体基于不完整信息继续执行或采取非预期操作之前介入。据 OpenAI 介绍,GPT-6.1 Sol 在涉及透明度、用户意图和明确限制的高难度评估中,表现优于 GPT-6 Sol。

使用受支持的 Amazon Bedrock API 构建应用时,您可以定义模型能够使用的工具,也可以决定应用在操作需要审批或无法完成时如何响应。这些应用层面的控制措施与模型能力的改进相辅相成,有助于您在工作流涉及重要决策时保持人工参与。

在 Amazon Bedrock 上运行 GPT-6.1 Sol

Amazon Bedrock 提供了在生产环境中运行 GPT-6.1 Sol 所需的基础设施和控制措施。您可以通过 AWS Identity and Access Management(IAM)策略管理模型访问权限,并通过 AWS CloudTrail 审计模型调用。您还可以使用由 AWS PrivateLink 提供支持的虚拟私有云(VPC)端点,帮助将流量保持在您的网络边界内。推理在采用硬件隔离、运维人员无法访问的基础设施上运行。因此,即使是 AWS 运维人员,也无法在推理过程中访问您的提示词和模型输出。

您的推理数据不会用于模型训练,使用 GPT-6.1 Sol 也不要求您同意与 OpenAI 共享数据。为进行自动化滥用检测,AWS 会将经分类器标记的流量最多保留 30 天,并通过程序自动处理。您可以通过您的 AWS 客户团队申请零数据留存。有关详情,请参阅数据留存说明。

开始使用

GPT-6.1 Sol 以更低的单任务成本,为智能体任务带来更强的推理能力,让您的智能体能够用更少的步骤获得正确答案。您可以在 Amazon Bedrock 控制台中开始使用 GPT-6.1 Sol,也可以通过受支持的 Amazon Bedrock API 以编程方式调用。有关支持的 AWS 区域、端点、API、功能、推理配置文件及定价的信息,请参阅 Amazon Bedrock 文档。

想了解 Amazon Bedrock 如何支持您的团队?欢迎联系我们,进一步交流。