岗位职责
- 负责Code和Agent相关数据构建与治理,构建高质量、多样化的Code/Agent训练数据集,搭建数据迭代闭环,通过数据飞轮持续优化数据质量;
- 负责Agent运行环境与训练环境的构建与优化,构建高可用、可扩展的Agent仿真环境,保障Agent训练、测试及落地的稳定性与高效性;
- 负责Agentic RL在Code/Agent场景的训练,参与Agentic RL Infra建设及优化、Agentic RL 算法优化,持续提升Agentic RL训练的效率和稳定性。
职位要求
- 计算机、人工智能等相关专业硕士以上学历;
- 有大规模强化学习、大模型Code/Agent研发相关经验者优先;
- 具有扎实的深度学习算法基础,熟悉深度学习框架和分布式训练推理加速,有实操经验者优先;
- 在多模态/CV/NLP等领域顶级会议(期刊)发表过论文、主导/参与业界知名的开源项目者优先;
- 具备极强的学习能力和技术追求,良好的团队合作和沟通能力。