Desarrollar y optimizar pipelines de datos para analítica, reporting e iniciativas de IA, en la plataforma Databricks Lakehouse. Transformar datos sin procesar en conjuntos de datos de alta calidad para consumo por BI y modelos de ML.
- Diseñar, construir y mantener pipelines ETL/ELT escalables en Databricks usando Python, SQL y Spark.
- Implementar y gestionar la arquitectura medallion (bronze/silver/gold) para refinar datos de fuentes diversas.
- Automatizar despliegues y orquestación de pipelines con Databricks Workflows, CI/CD y herramientas como Terraform.