亚马逊AWS官方博客
构建 AI 驱动的 EKS 集群健康诊断 SaaS 平台 – 从静态规则到 MCP Agent 自主分析
本文介绍了一个面向 Amazon EKS 用户的 AI 驱动集群健康诊断 SaaS 平台,该平台通过”确定性规则 + AI 关联分析 + MCP Agent 自主诊断”三层架构,实现从静态规则检查到 AI Agent 按需实时采集集群数据的智能化运维诊断,帮助用户快速定位集群配置风险并获得可执行的修复建议。
从一键部署到 AI 洞察:基于 Serverless 架构与 LLM 的压测与分析平台 Load Testing Pilot
性能测试是保障系统稳定性的关键环节,然而分布式压测环境搭建复杂、客户端指标与服务端基础设施指标割裂、测试结果分析高度依赖专家经验,仍是许多团队面临的共性挑战。本文介绍 Load Testing Pilot——一个专为亚马逊云科技中国区域设计,通过单一 Amazon CloudFormation 模板实现一键部署的 Serverless 分布式压测与智能分析平台。平台支持多压测引擎与 LLM 自然语言生成脚本,可在压测结束后自动沿负载均衡器至后端实例的链路发现关联资源、采集全链路监控指标,并由 LLM 生成涵盖健康判定、瓶颈定位、根因分析与优化建议的结构化报告。
用 Kiro 构建行业专业软件:从需求到交付的地震多次波压制工具实践
本文记录了一次用 Kiro 开发行业垂直软件的完整实践:在 5天跨度内、纯编码约十余小时,构建出一套面向陆上叠前数据的地震多次波压制处理系统,交付约 2,408行代码与文档,涵盖预测反褶积、双曲 Radon 变换、SRME 三种经典算法,以及 CLI、桌面 GUI 与多炮并行流水线。文章以真实的 git记录和测试输出还原开发过程,并坦诚讨论了算法在小合成数据上的适用边界——预测反褶积接近论文最佳水平,而 Radon 与 SRME受方法本身限制效果有限,价值在于工程落地而非指标刷榜。在方法论层面,本文以同一项目为样本对比了 Spec 驱动与 Vibe Coding两种范式:算法内核以 Spec 固化统一接口规范,GUI 则以探索式迭代快速成型,并给出”内核用 Spec、外围用vibe、衔接靠接口”的分层结论。核心观点是:AI不会替你突破方法的物理边界,但能把”领域知识转化为可运行、可扩展代码”这一过程的成本显著拉低。
MTP 加速推理最佳实践:在亚马逊云科技中国区使用 llama.cpp 部署 Qwen3.6 的实测指南
本文在亚马逊云科技中国区(宁夏)使用 llama.cpp 部署 Qwen3.6 系列大语言模型(27B Dense 和 35B-A3B MoE),对比了 Graviton4 ARM CPU、Intel x86 CPU 和 NVIDIA A10G GPU 三种硬件平台上 MTP (Multi-Token Prediction) 投机解码的实际加速效果,并给出了各芯片架构下的部署最佳实践。
使用 Pub/Sub 逻辑复制实现 Aurora PostgreSQL 大版本近零停机升级
Amazon Aurora PostgreSQL 大版本升级有多种方案可供选择。本文聚焦于手动蓝绿部署(Clone + 原生 Pub/Sub)方案,深入介绍如何利用 PostgreSQL 原生逻辑复制能力,以分钟级停机时间完成 Aurora PostgreSQL 大版本升级。
文中以 PostgreSQL 13 升级至 PostgreSQL 17 为例进行说明,相同步骤适用于其他 Aurora PostgreSQL 大版本升级组合(如 PG11→PG15、PG14→PG17 等)。本文还重点讲解针对高写入量表的并行订阅任务拆分技巧,以及完整的回滚保障机制。
基于 Amazon Bedrock 的 Apache SeaTunnel AI CLI 模型评测:从配置生成到真实执行
本文以 Apache SeaTunnel AI CLI 项目为基础,通过 Amazon Bedrock 的统一模型访问层,对 7 个模型完成 100 个 ETL 任务的分层评测:不仅衡量配置生成和静态校验结果,也在真实数据环境中验证执行。实验显示,模型在静态校验阶段的表现不能直接预测其真实执行成功率。本文的目标不是给出一份通用模型排行榜,而是提供一套面向 AI 辅助 ETL 的评测与选型方法:团队应结合自身任务复杂度、运行时成功率、错误修复能力和总体成本,持续选择并验证最适合自身数据环境的模型组合。
Amazon Bedrock AgentCore Gateway 内置 Web 搜索工具实战
通过 MCP 将 Web Search Tool 集成到 AgentCore Gateway,为 AI Agents 提供实时网络搜索能力。
Amazon EFS 目录级配额监控:多租户 SaaS方案
Amazon EFS 不提供原生目录级配额能力。本文基于 AWS Lambda 双层 fan-out 架构与 Amazon EventBridge,给出按客户/项目两级目录粒度的存储用量监控方案,涵盖架构设计、完整代码、部署命令及成本分析。
使用飞书实现 Amazon Quick 统一单点登录(Web + Desktop)
飞书授权登录并非标准 OIDC,无法直接作为 Amazon Quick 的 IdP。本文介绍一个开源的全 Serverless 参考实现:用 Lambda + API Gateway 构建飞书 OIDC 适配器,KMS 非对称密钥签发 id_token,以 Cognito 为身份枢纽,实现 Quick Web 与 Desktop 的飞书统一单点登录。
AI-DLC 在数据工程中的实践:从分层建模到数据质量的全流程协作
本文将介绍 AI-DLC(AI-Driven Development Life Cycle)——亚马逊云科技于 2025 年提出的一套开发方法论——在数据工程场景中的落地实践。我们将通过两个真实案例,展示 AI-DLC 如何在分层建模和数据质量管理这两个数据工程核心场景中发挥价值。