岗位职责
- 从事大模型智能体(LLM Agent)的研究;
- 为大模型设计新的记忆系统、工具利用、环境交互、规划、反思等机制,探索复杂任务中的强化学习方法,扩展大模型解决复杂问题的能力边界;
- 开发和优化智能创作Agent,提升其指令遵从能力、安全性和创作能力,打造行业领先的智能创作Agent;
- 前沿算法技术的持续跟踪和创新,包括但不限于代码生成、视频创作、多智能体系统、强化学习、数据合成等领域;
- 参与孵化与智能体技术相关的新产品。
职位要求
- 数学、计算机、控制科学、软件工程、人工智能等相关学科,硕士研究生及以上学历;
- 熟悉大模型的相关基础知识,具备大语言模型相关训练或推理的基础知识;
- 熟悉LLM的训练或Fine-tuning的方法,例如SFT/RLHF经验,或熟悉强化学习(RL)概念深入了解DPO、PPO相关算法知识;
- 有大模型对齐项目经验,有agent开发、优化经验者优先;
- 扎实的Python或者C++编程功底,了解PyTorch,Tensorflow,Deepspeed,Megatron,vLLM等大模型训练、推理技术栈;
- 对技术有热情,关注大模型新研究和论文,对大模型的应用有兴趣;
- 有独立解决问题的能力,有良好的技术沟通及协作能力,并乐于推动项目中问题的解决; 加分项:
- 有智能体研发与应用的成功经验;
- 顶会论文、算法比赛奖项。