Amazon Web Services ブログ
週刊AWS – 2026/9/14週
みなさん、こんにちは。ソリューションアーキテクトの古屋です。今週も 週刊AWS をお届けします!
シルバーウィークの 5 連休、いかがお過ごしでしたか。どんどんと日が短くなり、1 年の残りを意識しはじめる季節になりましたね。
年末といえば、そのハイライトとなる AWS re:Invent 2026 が、いよいよ視界に入ってきました!今年は 11 月 30 日 (月) から 12 月 4 日 (金) までラスベガスで開催され、2,200 以上のセッションが予定されています。残りは 2 か月あまり。現地参加を検討されている方は、そろそろ社内の調整や渡航準備を動かし始めるタイミングですね。その判断材料として、AWS Startup ブログの連載 ラスベガス5日間で得たもの ── re:Invent に賭けたスタートアップのリアル をぜひご覧ください。技術のキャッチアップはもちろん、事業を動かす出会いやエンジニア採用にまで話が及んでいて、「現地でしか得られないもの」がとても具体的に語られています。記事は随時公開予定です。
それでは、先週の主なアップデートについて振り返っていきましょう。
2026年9月14日週の主要なアップデート
- 9/14(月)
- Gemma-4-31B-it-assistant および Gemma-4-31B-IT-NVFP4 モデルが Amazon SageMaker JumpStart で利用可能に
Google DeepMind の Gemma-4-31B-it-assistant と NVIDIA の Gemma-4-31B-IT-NVFP4 が Amazon SageMaker JumpStart に追加されました。前者は Gemma 4 ファミリーのフラッグシップである 31B の dense モデルのアシスタント調整版で、テキストと画像の入力、256K トークンのコンテキストウィンドウ、140 以上の言語、ネイティブな関数呼び出し (function calling) に対応します。後者は NVIDIA ModelOpt で 4 ビット FP4 (NVFP4) に量子化した派生版で、メモリ使用量を約 18.5 GB (ベースモデル比 68% 削減) に抑え、約 2.5 倍高速な推論を実現しながら元モデルの 97〜99% の品質を維持します。SageMaker コンソールまたは SageMaker Python SDK から数クリックでデプロイできます。 - Qwen3.6-35B-A3B-NVFP4 および Wan2.1-T2V-1.3B-Diffusers モデルが Amazon SageMaker JumpStart で利用可能に
NVIDIA が量子化した Qwen3.6-35B-A3B-NVFP4 と Alibaba の Wan2.1-T2V-1.3B-Diffusers の 2 つの基盤モデルが Amazon SageMaker JumpStart に追加されました。前者はエージェント型コーディング、マルチモーダル推論、長文コンテキスト理解に向けた Mixture-of-Experts (MoE) モデルで、NVFP4 量子化によりメモリ使用量を大幅に削減しています。後者は 1.3B パラメータのテキストから動画を生成するモデルで、8.19 GB の VRAM で動作します。いずれも SageMaker コンソールまたは SageMaker Python SDK から数クリックでデプロイできます。
- Gemma-4-31B-it-assistant および Gemma-4-31B-IT-NVFP4 モデルが Amazon SageMaker JumpStart で利用可能に
- 9/15(火)
- Amazon Q Console から CloudTrail イベントを自然言語で分析
AWS CloudTrail が Amazon Q Console と統合され、自然言語で AWS アカウントのアクティビティを調査できるようになりました。SQL クエリの記述やログファイルの手動解析なしに、CloudTrail の設定確認、セキュリティ調査、運用トラブルシューティングを実行できます。Amazon Q Console はユーザーに代わって CloudTrail の証跡 (Trail)、関連する CloudWatch Logs ロググループ、CloudTrail Lake のイベントデータストアをクエリし、一般的なドキュメントではなく実際のアカウントアクティビティに基づいた回答を返します。Amazon Q Console がサポートされるすべての AWS 商用リージョンで利用できます。 - AWS Direct Connect が専用接続の定額料金 (flat-rate pricing) を発表
AWS Direct Connect は、10 Gbps および 100 Gbps の専用接続 (Dedicated Connection) を対象とした定額料金モデルを発表しました。接続の帯域幅と、選択した地理的スコープに応じた月額固定料金を支払うことで、選択した料金ティアの範囲内であればデータ転送アウト (DTO) の課金が発生しません。地理的ティアは同一メトロからグローバルまでの 5 段階が用意されており、トラフィックのパターンに合った範囲を選べます。あわせて、冗長用の 2 本目のポートを追加料金なしで含む「ポートペア (port-pair)」という新しいプロビジョニング方式が導入されました。ポートペアの利用は推奨されていますが任意です。課金モードは接続ごとに設定でき、従量課金との切り替えも可能です。中国リージョンを除くすべての AWS 商用リージョンの Direct Connect ロケーションで利用できます。
- Amazon Q Console から CloudTrail イベントを自然言語で分析
- 9/16(水)
- Amazon Connect Talent が一般提供開始
Amazon Connect Talent は、AI エージェントが候補者の音声面接とスキル評価を代行する採用ソリューションで、今回一般提供を開始しました。Amazon が数十年にわたって蓄積してきた採用サイエンスに基づいて設計されており、構造化された AI 音声面接、コンピテンシーベースの評価、一貫した基準での候補者スコアリングを提供します。料金は候補者評価 1 件の完了につき 20 USD の従量課金で、シートライセンスや最低利用量のコミットメントはありません。初回利用のお客様は AWS 無料利用枠で最大 200 USD 相当のクレジットを利用できます。現時点ではバージニア北部リージョンとオレゴンリージョンのみで利用可能です。 - Amazon Connect Customer がカスタムメトリクスの API による作成・管理・検索に対応
Amazon Connect Customer に、カスタムメトリクスをプログラムから管理するための 7 つの API (CreateMetric、DeleteMetric、DescribeMetric、ListMetrics、SearchMetrics、UpdateMetricContent、UpdateMetricMetadata) が追加されました。これまでコンソールでの手動作業が必要だったカスタムメトリクスの定義を、コードとして一元管理できるようになります。複数のインスタンスや環境にメトリクス定義を展開する際の定義のずれ (drift) を防ぎ、すべての変更は AWS CloudTrail に記録されます。Amazon Connect Customer が提供されるすべての AWS リージョンで利用できます。 - Amazon ECS が Amazon S3 Files のサポートを Amazon EC2 起動タイプに拡張
Amazon ECS の EC2 起動タイプで実行するタスクから、Amazon S3 Files ボリュームをマウントできるようになりました。S3 Files は Amazon EFS 上に構築された共有ファイルシステムで、S3 バケット内のデータをコード変更なし、コピーやステージングなしに標準的なファイル操作で読み書きできます。これまで AWS Fargate と Amazon ECS Managed Instances で利用可能でしたが、今回の拡張によりAmazon ECS を含む 3 つの起動タイプすべてで同じ仕組みを使えるようになりました。すべての AWS 商用リージョンと AWS GovCloud (US) リージョンで利用できます。
- Amazon Connect Talent が一般提供開始
- 9/17(木)
- Amazon Quick が個別シートの生成と画像からの分析構築に対応
Amazon Quick の Generate Analysis 機能が拡張され、ダッシュボード作成を効率化する 2 つの機能が追加されました。1 つ目の Generate Sheet は、開いている分析の中に自然言語の指示だけで単一のシートを追加する機能です。2 つ目は、既存ダッシュボードの画像 (他社 BI ツールのものを含む) をプロンプトに添付し、編集可能な分析として再構築する機能です。どちらも生成結果は通常の Amazon Quick の分析であり、公開ワークフロー、埋め込み、CI/CD パイプライン、手動編集とそのまま組み合わせて使えます。提供開始時点では Enterprise サブスクリプションの Author Pro ユーザーが対象で、Author ユーザーも、組織がアクセスを制限していない場合は 2026 年 12 月まで Amazon Quick Enterprise のプロモーションアクセスで利用できます。どちらの機能も、Amazon Quick が利用可能なすべての AWS リージョンで一般提供されています。 - AWS Elastic Beanstalk が共有インフラストラクチャ上で複数のアプリケーションを実行する Cluster Mode を導入
AWS Elastic Beanstalk に新しいデプロイモード「Cluster Mode」が追加されました。従来の Standard Mode がアプリケーションごとに専用環境を作るのに対し、Cluster Mode は Amazon EKS を基盤とする、アカウント内のプールされたインフラストラクチャ上で複数のアプリケーションを実行します。ソースコード、Dockerfile、Amazon ECR のコンテナイメージのいずれかを渡すだけで、コンテナ化からプロビジョニング、運用まで Elastic Beanstalk が管理するため、Kubernetes の運用は Elastic Beanstalk 側に任せられます。追加料金はなく、EKS クラスターと EKS Auto Mode を含む消費リソース分のみ課金されます。Elastic Beanstalk が提供されるすべての AWS 商用リージョンで利用できます。 - AWS Transfer Family が Network Load Balancer (NLB) 配下の SFTP サーバーで送信元 IP 保持をサポート
AWS Transfer Family の SFTP サーバーが、PROXY protocol v2 (PPv2) によるクライアント送信元 IP の保持に対応しました。従来、VPC ホスト型エンドポイントの前段に NLB を配置すると、Transfer Family には NLB のプライベート IP しか見えず、ログ、イベント、カスタム ID プロバイダーの認証リクエストに実際のクライアント IP が記録されませんでした。本アップデートにより、NLB ターゲットグループの PPv2 と、サーバー側で SftpMode を PROXY_PROTOCOL_V2_ENFORCED に設定することを組み合わせて、クライアントの実 IP を IP ベースの認可、監査、コンプライアンス用途に利用できます。なお強制モードに切り替える際は、先に NLB ターゲットグループ側で PPv2 を有効化し、すべての接続で PPv2 ヘッダーが届いていることをログで確認してから切り替えてください。ヘッダーのない経路が残っていると、その接続は拒否されます。あわせて、VPC エンドポイントのセキュリティグループは信頼する NLB 経由の通信のみを許可するよう制限する必要があります。Transfer Family が利用可能なすべての AWS リージョンで利用できます。
- Amazon Quick が個別シートの生成と画像からの分析構築に対応
- 9/18(金)
- AWS PrivateLink がネットワークセグメントへのアクセスを可能にする Tunnel Endpoint を発表
AWS PrivateLink に新しいタイプの VPC エンドポイントである Tunnel Endpoint が追加されました。CIDR 範囲 (ネットワークセグメント) を表す Resource Configuration を作成して AWS RAM で共有すると、共有を受けた側は Tunnel Endpoint を作成し、GENEVE カプセル化を使ってその CIDR 範囲内のリソースにプライベートにアクセスできます。従来はリソースを 1 つずつ Resource Configuration として登録する必要がありましたが、CIDR 単位での共有により、外部のベンダーなどに多数のリソースをまとめて共有できます。料金は Tunnel Endpoint の時間課金と、エンドポイントを通過したデータ処理量に応じた GB 単価の課金です。東京リージョン、大阪リージョンを含む 28 リージョンで利用できます。 - 新しい AgentCore Runtime が Amazon Bedrock AgentCore で利用可能に
Amazon Bedrock AgentCore のサーバーレス microVM コンピュートである AgentCore Runtime の次世代バージョン (platformVersion V2) が利用可能になりました。V2 の主眼は、コンテナイメージのサイズや同時実行数に関係なくコールドスタート時間が一定になることです。エージェント環境を一度準備してスナップショットを取得し、新しいインスタンスはそこから復元する方式により、200 MB から 2 GB のコンテナイメージで P75 コールドスタート 1.9〜2.0 秒を達成しています (V1 は 5.4〜30 秒)。またエラスティックメモリ管理 (elastic memory management) により、セッション中に未使用となったメモリを回収し、ピークではなく実使用量に基づいて課金されます。事前プロビジョニング不要、ゼロスケール、ハードウェアレベルのセッション分離といったサーバーレスの特性はそのまま維持されます。バージニア北部、オハイオ、オレゴン、アイルランド、東京の 5 リージョンで利用でき、ランタイムの作成時と更新時に platformVersion を V2 に設定するだけで有効化できます。 - Moonshot AI の Kimi K3 が Amazon Bedrock で一般提供開始
Moonshot AI の Kimi K3 が Amazon Bedrock で一般提供を開始しました。Moonshot AI によると、Kimi K3 は同社の最も高性能なモデルであり、オープンモデルとして初めて 2.8 兆パラメータに到達したモデルです。ネイティブなビジョン機能と 100 万トークンのコンテキストウィンドウを備え、大規模リポジトリをまたぐ長時間のコーディングセッション、スキャンページやスクリーンショットを含む複数ドキュメントの分析、長時間のエージェントワークフローに適しています。Moonshot AI によると、前世代の Kimi K2 と比較してスケーリング効率が約 2.5 倍向上しています。Bedrock 上のオープンウェイトモデルとして初めて明示的プロンプトキャッシュに対応し、キャッシュ読み取りは通常入力の 10 分の 1 の単価で課金されます。提供はクロスリージョン推論経由で、Amazon Bedrock が利用可能なすべての AWS リージョンから呼び出せます。US Geo 推論プロファイルとグローバル推論プロファイルが用意されており、東京リージョン、大阪リージョンからも利用できます。
- AWS PrivateLink がネットワークセグメントへのアクセスを可能にする Tunnel Endpoint を発表
それでは、また来週お会いしましょう!