Empresa: name
Ingeniero de Aprendizaje Autónomo para diseñar, entrenar y desplegar soluciones de refuerzo (RL) en sistemas de decisión complejos. Remoto 100% en EE.UU. Requiere 6+ años de experiencia en RL.
6+ años
Diseñar e implementar soluciones de RL; desarrollar y optimizar entornos de simulación y pipelines de entrenamiento; implementar y evaluar algoritmos modernos de RL y modelos de recompensa; mejorar rendimiento y estabilidad; colaborar con equipos para desplegar soluciones en producción; monitorear modelos desplegados.
Python, deep learning, reinforcement learning, entornos de simulación, RLHF, entrenamiento distribuido.
Tipo de Contrato
Tiempo completoModalidad del Empleo
PresencialIdioma
Inglés - Avanzado