Amazon EMR sin servidor ahora admite procesos de trabajo de mayor tamaño para ejecutar cargas de trabajo con un uso más intensivo de memoria y procesamiento
Amazon EMR sin servidor ahora ofrece configuraciones de trabajo más grandes de 32 vCPU con hasta 244 GB de memoria, lo que le permite ejecutar más cargas de trabajo con un uso intensivo de memoria y procesamiento. Anteriormente, la configuración de los procesos de trabajo de mayor tamaño disponible en EMR sin servidor consistía en 16 CPU virtuales con hasta 120 GB de memoria. Los procesos de trabajo de gran tamaño pueden ayudarlo a mejorar el rendimiento del tiempo de ejecución, así como los perfiles de costos de sus cargas de trabajo.
En el caso de las cargas de trabajo con un uso intensivo de operaciones de shuffle, los procesos de trabajo de mayor tamaño reducen las transferencias de datos ineficientes entre los ejecutores. En los trabajos con sesgo de datos, los procesos de trabajo de mayor tamaño reducen las probabilidades de que produzcan errores por falta de memoria. Para los trabajos que necesitan almacenar datos en caché, los procesos de trabajo de mayor tamaño permiten almacenar más datos en la memoria, lo que mejora el rendimiento laboral. Para aprovechar estas ventajas, le recomendamos que utilice procesos de trabajo de mayor tamaño para sus cargas de trabajo de Spark e Hive que hacen uso intensivo de memoria o procesamiento.
Para obtener más información sobre las diferentes configuraciones de los procesos de trabajo, consulte la documentación de EMR sin servidor. Los procesos de trabajo de gran tamaño están disponibles en todas las regiones de AWS en las que está disponible EMR sin servidor.