Amazon Web Services ブログ

Category: Amazon Simple Storage Service (S3)

Amazon DynamoDB から Amazon S3 へのフィルター付きエクスポート機能のご紹介

本ブログでは、Amazon DynamoDB の新機能であるフィルター付きエクスポートについてご紹介します。この機能を使うと、ExportTableToPointInTime リクエストに FilterSpecification を指定することで、必要なアイテムや属性のみを Amazon S3 へエクスポートでき、テーブルのキャパシティを消費しません。マルチテナント環境における特定テナントのリカバリ、属性を限定したデータ共有、Amazon Athena を用いた影響分析、別リージョンへの移行といった実践的なユースケースを通して、効率的なデータ運用方法を学べます。

Amazon Aurora PostgreSQL がデータレイク上の Apache Iceberg と Parquet データへの直接クエリをサポート

Amazon Aurora PostgreSQL で、データレイクに保存された Apache Iceberg および Apache Parquet 形式のデータを直接クエリできるようになりました。DuckDB が Aurora PostgreSQL に組み込まれ、ETL パイプラインなしで運用データとデータレイクのデータを 1 つのクエリで横断的に分析できます。

Amazon S3 Vectors がメタデータの pre-filtering に対応し、フィルター付き検索の再現率が向上

Amazon S3 Vectors でメタデータの事前フィルタリングが利用可能になりました。類似度検索の前にメタデータフィルターを評価することで、フィルター付きクエリの再現率が向上します。前方一致演算子 $startsWith も新たに追加され、追加料金やデータの再取り込みなしで既存のインデックスでも有効にできます。

RDS for SQL Server インスタンスを License Included から Bring Your Own Media (BYOM) へ変換

本記事では、RDS for SQL Server インスタンスを License Included から Bring Your Own Media (BYOM) へ変換するためのインストールメディアの準備、BYOM エンジンバージョンの作成、インプレースでのライセンスモデル変更というエンドツーエンドの変換プロセスを説明します。

DuckDB で Amazon S3 Tables に格納された表形式データセットへのアクセスを効率化する

DuckDB は軽量なインメモリ SQL エンジンで、追加のサーバー運用なしに対話型のデータ分析を実現します。本記事では、Amazon SageMaker Lakehouse Iceberg REST エンドポイントと AWS Lake Formation のアクセス許可を利用して、AWS CloudShell 上の DuckDB から Amazon S3 Tables に格納された Iceberg テーブルにアクセスし、クエリを実行する手順を紹介します。

Kite、AWS HealthOmics を活用し細胞治療研究向けのスケーラブルなバイオインフォマティクスを推進

Gilead 傘下の Kite は、プロジェクトごとに分断されていたバイオインフォマティクスのワークフローを、AWS HealthOmics を軸にした標準化されたクラウド基盤へ移行しました。本記事では、オンプレミスのシーケンサーから電子実験ノート (ELN) を入口にしたワークフロー実行までを自動化したイベント駆動アーキテクチャと、その設計上の判断を紹介します。18 か月以上の本番稼働で 20 個のワークフローを運用し、100 名を超える研究者が ELN からバイオインフォマティクスワークフローを利用できるようになりました。

Outpost VFX が ビジュアルエフェクト向けに AI モデルのトレーニングを AWS で加速した方法

本記事では、Outpost VFX が AWS インフラを活用してトレーニング速度を 8 倍に向上させ、顔置換ワークフローを刷新した方法、単一 GPU の限界を克服するために実装した技術アーキテクチャ、そして AWS マルチ GPU トレーニングで得られた具体的な成果について紹介します。