Profesional técnico para diseñar y desplegar LLMs y capacidades de IA en productos de desarrollo. Enfocado en rendimiento y escalabilidad en entornos multi-GPU.
Diseñar y entrenar LLMs desde cero en clusters GPU
Recoger y procesar datasets de preentrenamiento y fine-tuning
Soportar e incrementar subsistemas existentes
Requisitos clave
Diseñar, desplegar y mantener sistemas ML en producción
Experiencia con PyTorch y entrenamiento distribuido de modelos de miles de millones de parámetros
Conocimientos de frameworks de LLM (vLLM, DeepSpeed, TensorRT) y técnicas de alineamiento RLHF/RLAIF