岗位职责
- 参与大规模MoE模型的预训练和持续预训练(cpt/midtrain):数据清洗与混合策略、训练调优与结果分析;
- 参与Agentic RL强化学习训练流程:数据构建、reward shaping、训练调优;
- 参与多语种机器翻译(MT)方向:语料处理、模型微调、评测;
- 参与Long horizon agentic RL 方向:轨迹构建,环境构建、优势与奖励设计。
职位要求
- 2027届应届毕业生,计算机科学、人工智能、计算机视觉等相关专业本科及以上学历,具备扎实的机器学习、深度学习理论基础,熟悉现代LLM架构。
- 熟悉常见大模型训练框架(Megatron/Verl/slime等)
- 有LLM相关项目经验:pretrain、CPT、SFT、RL、non parametric 任意方向即可
- 有阅读论文与复现能力,能快速上手实验
- 良好的自我学习能力和独立思考能力 加分项:
- 有相关领域顶会论文,或开源项目
- 有coding agent harness或模型训练经验
- ACM/OI获奖
- 熟练使用AI agent能力者