Diseñar y optimizar pipelines de datos utilizando Python y PySpark en entornos big data, con enfoque en procesamiento batch y ETL/ELT.
- Diseñar y desarrollar pipelines de datos robustos y escalables.
- Procesar y transformar grandes volúmenes de información mediante PySpark y SQL.
- Optimizar rendimiento de procesos ETL/ELT y consultas en bases de datos relacionales.