Rol técnico orientado a infraestructuras de IA y HPC. Enfoque en observabilidad, capacidad y rendimiento, con foco en entornos Linux, Docker y clusters GPU. No implica desarrollo software tradicional.
- Diseñar la capacidad, planificar demanda y definir el roadmap de infraestructuras de IA y HPC.
- Mantener y evolucionar dashboards de monitorización (Prometheus, Grafana) y supervisar uso de GPUs en clusters.
- Gestionar el ciclo de vida de la infraestructura, optimizar recursos, seguridad y escalado, y elaborar reporting para dirección.