Diseñar, construir y optimizar soluciones de datos escalables para respaldar análisis, ML e informes, utilizando Spark y entornos en la nube.
- Diseñar, desarrollar y optimizar pipelines de datos utilizando Apache Spark, principalmente con Scala/Spark.
- Construir soluciones de procesamiento por lotes y near real-time en entornos de alto volumen de datos.
- Colaborar con ingeniería de datos, ciencia de datos y negocio para entender requisitos y entregar soluciones prácticas.