Rol técnico para diseñar y optimizar procesos de procesamiento distribuido de datos con Apache Spark. Implementar pipelines en AWS Glue y EMR y colaborar con arquitectos de datos para soluciones escalables.
Diseñar e implementar procesos de procesamiento distribuido de datos con Apache Spark
Desarrollar y mantener pipelines de datos en AWS Glue y/o Amazon EMR
Analizar e interpretar queryplans y usar SparkUI para identificar cuellos de botella y optimizar rendimiento
Requisitos clave
Experiencia sólida en Apache Spark (PySpark o Scala).
Conocimiento avanzado de AWS Glue y/o Amazon EMR.
Experiencia en ETL/ELT en entornos distribuidos y manejo de Python.
Otro / No especificado
IdiomasCastellano
Años de experienciaOtro / No especificado
Más ofertas de Informática / Tecnología en Vizcaya