Desarrollar y optimizar soluciones de procesamiento de datos en entornos de gran volumen y arquitecturas cloud (AWS). Implementar pipelines y procesos por lotes con Python y PySpark.
- Desarrollar soluciones de procesamiento de datos con Python y PySpark.
- Construir, mantener y optimizar pipelines de datos.
- Monitorear procesos batch, analizar incidencias y revisar logs para troubleshooting y rendimiento.