Rol técnico de liderazgo para diseñar y entregar una pila de GPU en infraestructura propia. Enfocado en escalabilidad, seguridad y observabilidad, para cargas de investigación e inference.
- Diseñar la arquitectura de la plataforma GPU end-to-end y mantenerla actualizada.
- Liderar y gestionar un equipo distribuido de ingeniería (backend, frontend, DevOps, QA y documentación).
- Implementar y operar la capa de scheduling de GPU (Slurm) y el plano de control de Kubernetes para inference.