跳至主要内容

全球顶尖模型,按需即用

Amazon Bedrock 汇聚 Claude、GPT、Grok 等全球前沿 AI 模型,提供统一 API 接口、全托管服务与企业级安全保障,让你的团队专注业务创新,而不是陷在基础设施运维中。数据不出亚马逊云科技边界,切模型不改代码,按需即用,即刻体验。

Missing alt text value

借助安全、灵活的技术,释放创新潜能

企业级安全合规

Zero Operator Access (ZOA) + Zero Data Retention (ZDR) 默认开启。没有运维人员可访问模型输入输出,安全隔离在硬件层面强制执行。数据不出边界,不用于训练,不分发给任何第三方。

节省成本

通过 Prompt Caching 对重复使用的长上下文进行缓存,后续请求直接从缓存读取,跳过重复计算。输入 token 成本可降低高达 90%,同时显著降低首 token 延迟。适用于 chatbot 文档问答、长 system prompt 的 Agent 工作流、批量分析等高频重复上下文场景。

模型选择灵活性

通过统一 API(Converse API)一套代码接入所有模型供应商。从 Claude 切到 GPT,从 Grok 切到 DeepSeek,无需适配不同厂商的 API 格式。当新模型发布时,团队只需更改一个参数,即可在现有生产工作流上验证新模型效果,不被任何单一供应商锁定。

质量与成本自动平衡

通过智能路由(Intelligent Prompt Routing),单一 serverless 端点自动在同一模型家族内的不同模型之间动态路由请求。系统预测每个请求在不同模型上的响应质量,将请求路由到适配度更高的模型,在保证输出质量的前提下自动优化成本和延迟。

全球顶级模型,一键接入

Anthropic Claude 系列

Anthropic 的 Claude 系列覆盖从顶级能力到生产主力的完整梯队,是构建 Agent 和企业级编码场景的优选。

  • Claude Fable 5:能力天花板 擅长软件工程、知识工作、视觉理解和科学研究。支持多日自主任务、跨阶段规划、子 Agent 委派和自我验证。代码库级迁移能力突出。
  • Claude Opus 5:企业旗舰款 1M token 上下文窗口,128K 输出。SWE-bench Pro 得分 79.2%,图像理解增强,token 效率更高。
  • Claude Sonnet 5: 性价比之选 专为编码、Agent 和专业工作设计,兼顾能力、速度和成本。限时促销中,是日常生产 AI 工作的默认选择。
aws-library_illustration_culture_3_1200

OpenAI GPT-5.6 系列

GPT-5.6 全系列保持 1.05M 上下文与 128K 输出一致,降价不缩水。

  • GPT5.6 Sol:旗舰推理 编码、研究、网络安全领域 SOTA 表现。支持 max reasoning effort 和 ultra mode。成本约为 Fable 5 的 1/3,适合高难度多步推理任务和 Agentic 工作流。
  • GPT5.6 Terra:生产力引擎 降价20%。企业日常工作流的默认落点,高性价比不牺牲上下文窗口。
  • GPT5.6 Luna:高吞吐经济型 系列中速度和经济性兼优的高吞吐模型。降价 80%。适合大规模批处理、高频 API 调用和成本敏感型应用。
aws-library_illustration_data_14_1200

xAI Grok 系列

xAI 的 Grok 系列面向长程 Agent 与强编码场景,提供卓越的能力和更低的价格。

  • Grok 4.6:强 Coding / 长程 Agent 专为长程 Agent 和复杂交互/视觉任务而生,500K 上下文窗口,四档可调推理强度(low/medium/high/xhigh)。支持跨区域推理 (Cross Region Inference),在所有提供 Bedrock 的区域可用。
  • Grok 4.3:高性价比推理 1M 上下文窗口。适合对成本敏感的推理任务、高频调用和大规模批处理场景。
aws-library_illustration_expertise_6_1200

模型选择为何对客户很重要

Veolia

了解 Veolia 如何利用 Amazon Bedrock 提供的几乎所有基础模型来实现自动化翻译服务、图像生成以及知识查询,从而解决关键的环境问题。

Vercel

了解 Vercel 如何利用 Amazon Bedrock 丰富的模型选项来促进实验和创新,同时凭借其可靠性和可扩展性为下一代体验提供突破性的开发者工具包。