Rol técnico para diseñar y mantener plataformas de monitorización y observabilidad basadas en Prometheus y Grafana, gestionando infraestructuras con GPU y entornos Linux.
- Monitorizar y analizar la utilización de GPU en clústeres mediante dashboards de Prometheus y Grafana.
- Diseñar, mantener y evolucionar plataformas de monitorización y observabilidad.
- Definir estrategias de escalado, renovación de hardware y optimización de costes.