Rol técnico para evaluar y endurecer modelos de IA, verificar exactitud y razonamiento, y proponer mejoras en prompts, guardrails y métricas de evaluación.
Diseñar planes de prueba y suites de regresión
Ejecutar evaluaciones con prompts y escenarios reales
Documentar fallos, identificar causas y proponer mejoras
Requisitos clave
Experiencia en evaluación de modelos ML/AI y seguridad/red-teaming
Conocimiento de marcos de pruebas y automatización (pytest, Python/SQL)
Habilidad para diseñar rubricas, entregar informes reproducibles y reportar bugs de alta calidad
Informática / Tecnología
FormaciónGrado Universitario
IdiomasInglés, Castellano
Más ofertas de Informática / Tecnología en Otro / No especificado