岗位职责
- 深度参与LongCat模型基础能力优化,包括但不限于指令遵循、幻觉、推理、智能体等;
- 探索大规模RL及多目标RL的训练方案,与上下游团队合作,构建长期稳定的RL Scaling训练能力,推动模型能力持续提升;
- 探索Long Horizon场景下大模型的优化方案,包括不限于数据合成、上下文管理、长上下文RL方案等。
- 团队扁平,人才密度高,美团“北斗计划”和博士员工比例高,近年团队在ICLR、NeurIPS、ICML、ACL等顶会累计发表论文数十篇,团队员工获EMNLP 2024 Outstanding Paper、ACL 2025 Outstanding Paper;
- 参与大语言模型核心技术研发,接触大规模RL、超长上下文、分布式训练和推理优化等前沿技术;
- 充足算力保障,拥有大规模分布式训练环境和丰富数据资源。
职位要求
- 对大模型开发流程有深入认知,熟悉预训练、指令微调、RL等流程与框架;
- 具备扎实的算法和数学理论基础及良好的编程基础,熟悉自然语言处理、生成式AI和机器学习等技术,熟悉Python、Java等至少一种编程语言,熟悉PyTorch等深度学习框架,对技术开发及应用有热情;
- 目标感强,善于分析和发现问题,拆解简化,有想法并乐于挑战自我,能够从日常工作中发现新的空间;
- 条理性强且有推动力,能够梳理繁杂的工作并建立有效机制,推动上下游配合完成目标。