Rol de I+D en IA enfocado en servir modelos y arquitecturas de inferencia para sistemas avanzados, con foco en rendimiento y escalabilidad en entornos con recursos limitados.
Diseñar arquitecturas de serving de modelos con alto rendimiento y baja latencia.
Implementar y probar pipelines de inferencia en entornos simulados y en producción.
Analizar cuellos de botella y optimizar consumo de memoria y ancho de banda.
Requisitos clave
Titulación en Informática o campo relacionado (preferible PhD en NLP/ML).
Experiencia demostrada en compilación y optimización de inferencia para dispositivos móviles y plataformas edge.
Conocimiento profundo de modelos de difusión y transformers, y técnicas de compresión y cuantización.
Grado Universitario
IdiomasCastellano, Inglés
Años de experienciaOtro / No especificado
Más ofertas de Informática / Tecnología en Otro / No especificado