岗位职责
专注于多模态智能体(Agent)及强化学习(RL)的研究与开发,如 browser use 等,推动下一代智能决策系统的创新。主要职责包括:
- 设计和构建基于 Qwen 系列模型的多模态 Agent,使其能够高效处理文本、图像、视频等多种信息,执行复杂任务;
- 实现和训练强化学习算法,探索如何在多模态环境下优化智能体的决策策略;
- 开发数据采集和环境建模工具,构建逼真的多模态交互环境;
- 参与系统评估与优化,设计高效的验证机制,确保智能体的稳定性与泛化能力;
- 撰写研究论文、技术文档,与团队共同推动技术突破,并提升行业影响力。
职位要求
- 计算机、人工智能或相关领域的扎实学术背景,熟悉大模型和强化学习的核心原理;
- 具备良好的编程能力,熟练使用深度学习框架(如 PyTorch),并能进行算法实现与优化;
- 对多模态大模型(文本、图像、视频等)及其在智能体决策中的应用有浓厚兴趣;
- 具备良好的科研能力,能够独立思考并探索创新方案;
- 加分项:有强化学习、智能体框架、或多模态大模型训练的相关经验;
- 加分项:在计算机视觉、自然语言处理、强化学习等方向的顶级会议发表过论文。