岗位职责
- 负责提升电商B2B场景下,多模态大模型对用户超长个性化上下文建模能力。
- 负责基于强化学习提升大模型多步骤工具调用能力,实现亿人亿面用户仿真能力。
- 构建大模型的角色扮演能力,构建高保真用户模拟器及评估体系,提升Agent训练效率。
- 负责LLM的前沿技术探索,沉淀可复用的垂域Agent体系化构建方案。
职位要求
- 计算机、人工智能或数学相关专业博士,有扎实的计算机知识和LLM功底。
- 掌握Qwen/DeepSeek-R1等LLM训练方式,常见PPO/GRPO/Self-Play等强化学习算法原理,有RL实操经验。
- 熟悉DeepResearch/Manus等Agent产品技术架构,有实际参与研发Agentic模型经验。
- 加分项:有多篇顶会paper和知名竞赛top名次,或参与知名开源项目。