Bảng Amazon S3 hiện hỗ trợ loại dữ liệu Biến thể dành cho Apache Iceberg V3
Bảng Amazon S3 hiện hỗ trợ loại dữ liệu Biến thể như được định nghĩa trong đặc tả Apache Iceberg phiên bản 3 (V3). Giờ đây, bạn có thể ghi dữ liệu bán cấu trúc như JSON trực tiếp vào Bảng S3 mà không cần xác định trước một lược đồ cố định, cho phép bạn đưa dữ liệu vào nhanh hơn trong khi vẫn đạt được hiệu năng truy vấn phân tích hiệu quả.
Với loại dữ liệu Biến thể, các công cụ tương thích với Apache Iceberg V3 sẽ phân tách dữ liệu bán cấu trúc của bạn thành các cột ẩn khi bạn ghi dữ liệu, tạo thống kê cột Parquet được các công cụ truy vấn sử dụng để tối ưu hóa như lược bỏ tệp, giúp giảm dữ liệu mà truy vấn phân tích của bạn sẽ quét. Bảng S3 cũng cung cấp bảo trì bảng liên tục, bao gồm cả nén, cho các cột Biến thể, vì vậy bạn có thể hợp nhất dữ liệu từ các tệp nhỏ thành các tệp lớn để các công cụ Iceberg có thể đọc.
Hỗ trợ Biến thể trong Bảng S3 Tables có sẵn ở các Khu vực AWS sau đây: Miền Đông Hoa Kỳ (Bắc Virginia), Miền Đông Hoa Kỳ (Ohio), Miền Tây Hoa Kỳ (Oregon), Châu Á Thái Bình Dương (Mumbai), Châu Á Thái Bình Dương (Seoul), Châu Á Thái Bình Dương (Singapore), Châu Á Thái Bình Dương (Sydney), Châu Á Thái Bình Dương (Tokyo), Canada (Miền Trung), Châu Âu (Frankfurt), Châu Âu (Ireland), Châu Âu (London), Châu Âu (Paris), Châu Âu (Stockholm) và Nam Mỹ (São Paulo).
Để tìm hiểu thêm, hãy xem Bảng Amazon S3 và Hướng dẫn quy định của AWS để làm việc với đặc tả định dạng bảng Iceberg phiên bản 3.