跳至主要内容

全球顶尖模型,按需即用

Amazon Bedrock 汇聚 GPT、Grok等全球前沿 AI 模型,提供统一 API 接口、全托管服务与企业级安全保障,让你的团队专注业务创新,而不是陷在基础设施运维中。数据不出亚马逊云科技边界,切模型不改代码,按需即用。GPT-5.6 全线降价,GPT-6 Astra 与 Grok 4.6 全新上线,立即开始构建。

Missing alt text value

全球顶级模型,一键接入

OpenAI GPT 系列

GPT-6 Astra: 新一代 OpenAI 旗舰模型,已在 Amazon Bedrock 正式可用。支持 Computer Use,当缺乏 API 或连接器时可直接接管软件界面操作,跨应用推进工作流。支持高达 100 万输入 token 上下文窗口及隐式与显式提示词缓存,减少重复计算,降低成本与延迟。

GPT-5.6 系列:全线降价,规格不缩水。Sol、Terra、Luna 三档均已降价,全系列保持 1.05M 上下文窗口与 128K 输出不变。Sol 旗舰推理,输入降 20%、输出降 33%,适合高难度多步推理和 Agentic 工作流;Terra 生产力引擎,降价 20%,企业日常工作流的高性价比之选;Luna 高吞吐经济型,降价 80%,输出价仅 $1.20/M token,适合大规模批处理和高频 API 调用。

Missing alt text value

xAI Grok 系列

xAI 的 Grok 系列面向长程 Agent 与强编码场景,提供卓越的能力和更低的价格。

  • Grok 4.6:强 Coding / 长程 Agent 专为长程 Agent 和复杂交互/视觉任务而生,500K 上下文窗口,四档可调推理强度(low/medium/high/xhigh)。支持跨区域推理 (Cross Region Inference),在所有提供 Bedrock 的区域可用。
  • Grok 4.3:高性价比推理 1M 上下文窗口。适合对成本敏感的推理任务、高频调用和大规模批处理场景。
aws-library_illustration_expertise_6_1200

Anthropic Claude 系列

Anthropic 的 Claude 系列覆盖从顶级能力到生产主力的完整梯队,是构建 Agent 和企业级编码场景的优选。最新发布的 Fable 5.1 进一步提升了编码与科学研究能力;Opus 5 提供 1M 上下文窗口与企业级旗舰性能;Sonnet 5 兼顾能力、速度与成本,是日常生产 AI 工作的性价比之选。

aws-library_illustration_culture_3_1200

借助安全、灵活的技术,释放创新潜能

企业级安全合规

Zero Operator Access (ZOA) + Zero Data Retention (ZDR) 默认开启。没有运维人员可访问模型输入输出,安全隔离在硬件层面强制执行。数据不出边界,不用于训练,不分发给任何第三方。

节省成本

通过 Prompt Caching 对重复使用的长上下文进行缓存,后续请求直接从缓存读取,跳过重复计算。输入 token 成本可降低高达 90%,同时显著降低首 token 延迟。适用于 chatbot 文档问答、长 system prompt 的 Agent 工作流、批量分析等高频重复上下文场景。

模型选择灵活性

通过统一 API(Converse API)一套代码接入所有模型供应商。从 Claude 切到 GPT,从 Grok 切到 DeepSeek,无需适配不同厂商的 API 格式。当新模型发布时,团队只需更改一个参数,即可在现有生产工作流上验证新模型效果,不被任何单一供应商锁定。

质量与成本自动平衡

通过智能路由(Intelligent Prompt Routing),单一 serverless 端点自动在同一模型家族内的不同模型之间动态路由请求。系统预测每个请求在不同模型上的响应质量,将请求路由到适配度更高的模型,在保证输出质量的前提下自动优化成本和延迟。

模型选择为何对客户很重要

Veolia

了解 Veolia 如何利用 Amazon Bedrock 提供的几乎所有基础模型来实现自动化翻译服务、图像生成以及知识查询,从而解决关键的环境问题。

Vercel

了解 Vercel 如何利用 Amazon Bedrock 丰富的模型选项来促进实验和创新,同时凭借其可靠性和可扩展性为下一代体验提供突破性的开发者工具包。