Amazon Redshift ahora admite tablas de Apache Iceberg v3
Amazon Redshift ahora admite la lectura y escritura de tablas de Apache Iceberg v3 en su lago de datos. Apache Iceberg es un formato de tabla abierta y su versión v3 agrega varias características nuevas. Con este lanzamiento, Amazon Redshift incorpora la compatibilidad con valores de columna predeterminados, linaje de filas y vectores de eliminación.
Con los valores de columnas predeterminados, puede definir un valor inicial que Amazon Redshift aplica cuando no se proporciona ningún valor. Esto simplifica la evolución del esquema a medida que agrega columnas a las tablas existentes. El linaje de filas expone pseudocolumnas que rastrean la identidad de cada fila y el número de secuencia de la última actualización, de modo que puede crear canalizaciones incrementales y flujos de trabajo de CDC (captura de datos de cambios) que procesen solo las filas modificadas. Los vectores de eliminación reemplazan los archivos de eliminación posicional de Iceberg v2 por mapas de bits compactos y comprimidos. Esto permite realizar lecturas y escrituras más rápidas en cargas de trabajo con actualizaciones y eliminaciones frecuentes, como la eliminación de registros por motivos de conformidad normativa. Puede crear una tabla v3 con CREATE TABLE <table>... USING ICEBERG TABLE PROPERTIES ('format-version' = '3') o actualizar una tabla v2 existente con ALTER TABLE <table> SET TABLE PROPERTIES ('format-version' = '3').
Los clústeres aprovisionados y sin servidor basados en Graviton de Amazon Redshift admiten el nuevo formato v3. Para obtener más información, consulte el características de Iceberg V3 en la documentación de Amazon Redshift.