Les tableaux Amazon S3 prennent désormais en charge le type de données Variant pour Apache Iceberg V3
Les tableaux Amazon S3 prennent désormais en charge le type de données Variant tel que défini dans la spécification Apache Iceberg version 3 (V3). Vous pouvez désormais écrire des données semi-structurées telles que JSON directement dans des tableaux S3 sans définir de schéma fixe à l’avance, ce qui vous permet d’obtenir des données plus rapidement tout en obtenant des performances de requêtes analytiques efficaces.
Avec le type de données Variant, les moteurs compatibles avec Apache Iceberg v3 déchiquètent vos données semi-structurées en colonnes masquées au fur et à mesure que vous les écrivez, générant des statistiques de colonnes Parquet que les moteurs de requête utilisent pour des optimisations telles que l’élagage des fichiers, qui réduit les données analysées par vos requêtes analytiques. Les tableaux S3 assurent également la maintenance continue des tables, y compris le compactage, pour les colonnes Variant, afin que vous puissiez consolider les données des petits fichiers dans des fichiers volumineux que les moteurs Iceberg peuvent lire.
La prise en charge des données Variant est disponible dans les Régions AWS Amérique du Sud (São Paulo), Asie-Pacifique (Mumbai), Asie-Pacifique (Séoul), Asie-Pacifique (Singapour), Asie-Pacifique (Sydney), Asie-Pacifique (Tokyo), Canada (Centre), Europe (Francfort), Europe (Irlande), Europe (Londres), Europe (Paris), Europe (Stockholm), USA Est (Ohio), USA Est (Virginie du Nord), et USA Ouest (Oregon).
Pour en savoir plus, consultez les sections Tableaux Amazon S3 et Recommandations AWS relatives à l’utilisation de la spécification du format de table Iceberg version 3.