岗位职责
- 负责提升大模型的“智商”,全链路(包含评估、Pretrain、SFT、RLHF等)提升大模型的逻辑推理、任务规划等能力;
- 研究数据合成、Scalable oversight,突破数据瓶颈,减轻对人类标注的依赖;
- 研究System2在推理、规划能力中的应用,用“慢思考”提升效果,优化模型基础能力;
- 探索如何构建稳健的评估方法,全面、客观、公正地评估模型的基础推理规划能力,以及和复杂环境的交互能力;
- 提升模型的工具调用、API交互能力,通过构建Agent、Mult Agent解决复杂问题。
职位要求
- 有大模型相关方向研究背景者优先;
- 优秀的代码能力、数据结构和基础算法功底,熟练C/C++或Python,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 在大模型领域,主导过项目或论文者优先;
- 出色的问题分析和解决能力,能深入解决大模型训练和应用存在的问题;
- 良好的沟通协作能力,能和团队一起探索新技术,推进技术进步。