亚马逊AWS官方博客

AWS 一周综述:Amazon Bedrock 上的 GPT-6 Sol 和 Luna、Claude Opus 5.5,Strands 框架等(2026 年 9 月 28 日)

如果用一个主题来概括上周,那就是“选择”。前沿模型不断涌现,有趣的问题不再只是“它有多智能?”而是“在当前这一步,哪个模型能在这种成本、这种延迟下最匹配需求?” 这正是过去几天在 Amazon Bedrock 上线的内容:来自 OpenAI 的 GPT-6 Sol 和 GPT-6 Luna,为您在“智能与效率”曲线上新增了两个选择点,以及来自 Anthropic 的 Claude Opus 5.5,这是 Claude 5.5 系列的首个成员。

GPT-6 Sol 专为开发和运维中高要求、重复性的工作而打造,而 GPT-6 Luna 则让聚焦且可重复的任务能够大规模地实际执行,并且两者的定价都显著低于其前代 GPT-5.6。与此同时,Claude Opus 5.5 相比 Opus 5 能用更少的令牌完成更多工作,并针对智能体编码和长时间运行的任务进行了调优。这三款模型让我喜欢的一点是,它们都指向同一个理念:让模型匹配作业,而不是每次都去选最大的模型。另一个话题是可观测性正在追上这个智能体时代,其中还包括一个我有幸亲自撰写的发布内容。

现在,我们来看看本周的 AWS 新闻…

上周发布的内容
以下是上周引起我注意的一些发布内容和更新:

  • Amazon CloudWatch Omni 简介:您现在可以在单一的协作体验中同时观测您的应用程序和智能体。Amazon CloudWatch Omni 基于 OpenTelemetry 构建,因此您现有的遥测数据无需重新配置,您的整个团队通过一个具有企业 SSO 的 URL 即可访问该遥测数据,无需控制台访问权限。它会自动发现您的服务,映射依赖项,并让 AWS DevOps 智能体进入调查会话,进而关联信号并跟踪根本原因。在智能体可观测性方面还有一篇配套文章,AWS 云运维博客上有一篇更深入的解析,介绍人工智能时代的可观测性是什么样子,另外还有关于最新资讯的公告,包含具体细节。如果您想了解更宏观的背景,Matt Wood 的 Wrong, not broken 是一篇很好的文章,讲述了为什么如今必须在“运行”这一层面来衡量正确性。
  • Amazon EventBridge 中的增强型自定义事件总线:Amazon EventBridge 现在提供增强型自定义事件总线,专为组织跨团队和账户扩展事件驱动型应用程序而打造。您现在可以通过 AWS RAM,部署一条在整个组织中所有账户间共享的集中式总线,并支持可选的事件排序、简化的订阅用户资源(将筛选、目标和重试捆绑在一起)、基于内容去重,以及针对 AWS Lambda 等目标的同步调用。新的入口/出口定价模型取代了多总线设置中叠加的跨账户路由费用,而您现有的总线会作为“经典”总线继续照常运行,不受影响。
  • Amazon SageMaker HyperPod 推理网关:您现在可以使用 Kubernetes 原生、具有 GPU 感知功能的路由层,为 Amazon SageMaker HyperPod 上的 LLM 推理提供前置入口,该路由层作为单一 Amazon EKS 托管附加项进行部署,无需更改应用程序。这不是轮询负载均衡,而是根据实时推理信号(KV 缓存利用率、队列深度、前缀缓存命中率、预测延迟等)进行路由,在混合硬件和突发场景中将第一个令牌的延迟减少多达 82%。适用于任何与 OpenAI 兼容的模型服务器,包括 vLLM 和 SGLang。
  • AWS 最终用户消息发送和 Amazon SES 的智能体技能:您现在可以通过用通俗语言询问您的人工智能编程智能体来构建和发送消息。Amazon SES 和 AWS 最终用户消息发送会发布 AWS MCP 服务器的智能体技能,为您的智能体提供经过验证的分步指导,进而完成诸如验证发送人身份、发送生产电子邮件或使用卡片和按钮构建品牌 RCS 智能体等任务。这些技能适用于 Claude Code、Codex、Cursor 和 Kiro,因此您无需在文档和控制台屏幕之间切换即可完成消息发送工作流程。

有关 AWS 公告的完整列表,请关注 AWS 最新资讯页面。

其他 AWS 新闻
以下是您可能会感兴趣的一些其他帖子和资源:

  • Strands 框架简介:Strands Agents 团队发布了 Strands 框架,这是一款完全组装好的通用智能体框架,可以在本地运行,也可以在任何地方,在 Apache 2.0 下部署。只需一行 Python 或 TypeScript 代码,即可接入您从 Amazon Bedrock、Anthropic、OpenAI、Google 或本地 Ollama 模型中选择的模型,而且附带了合理的默认值,用于提示缓存和上下文管理(截断庞大的工具结果,在上下文窗口填满时进行压缩,并在运行期间保留内存)。该团队报告说,在保持准确性稳定的同时,其成本比相同模型的同类框架低约 28%。
  • 宣布发布关于人工智能的新 AWS Reimagine 报告:AWS Executive in Residence 团队历时九个月,采访了 27 个国家/地区的 154 位领导者,探讨将人工智能转化为价值的组织与未能做到这一点的组织之间的差异。这份报告很坦诚(包括人工智能在亚马逊内部哪些地方没有奏效),而反复出现的洞察是:一旦构建速度变快,瓶颈就会转移到对工作的决策、资金分配和治理上。如果您正在考虑您的团队如何在实践中采用人工智能,这篇文章值得一读。

要获取 AWS Blog 文章的完整列表,请务必关注 AWS Blog 页面。

即将举行的 AWS 活动
查看您的行程并报名参加即将举行的 AWS 活动:

  • AWS re:Invent:AWS re:Invent 将于 11 月 30 日至 12 月 4 日重返拉斯维加斯,会议时间、地点和演讲者信息已上线。预约座位将于 10 月 6 日开放,请立即注册,准备好抢占图示演讲、讲习会和开发人员小组研讨会中的席位。
  • AWS Summit:随着 re:Invent 的临近,今年的 Summit 即将结束。最后一站是迪拜(9 月 30 日),在迪拜世界贸易中心举办,设有 60 多场会议、AWS Village 展区以及动手实践讲习会。

加入 AWS 构建者中心,与构建者建立联系、分享解决方案并获取支持您的开发工作的内容。在此处浏览即将举行的 AWS 主办的线下和线上活动以及面向开发人员的活动。以上就是本周的全部内容。欢迎下周一继续查看新的“一周综述”!

— Daniel Abib