岗位职责
- 负责通用模型 Qwen 的代码能力和代码专有模型 Qwen-Coder 的构建。 (1)包括但不限于数据收集、预训练、后训练(强化学习)、评测等方向上的探索。 (2)我们坚持 Large-scale Pre-training 和 Large-scale RL 来提升 Code Reasoning 能力,在专家级编程竞赛超越人类,并构建 Coding Agent 来解决真实世界软件开发任务。
- 负责 Computer-Use Agent (GUI-Agent)的建设,以最直观的方式—鼠标、键盘、编码等操作来代替人类执行数字世界任务。 (1)通过 Scaling 海量数字世界数据结合大规模合成数据,来提升 Computer-Use Agent 的 Grouding 能力。 (2)通过 Long Horizon 的方式进行强化训练,结合可扩展的多模态环境反馈来提升 CU Agent 的 Reasoning 的能力。
职位要求
- 计算机科学、人工智能、机器学习等领域的博士/硕士毕业生。
- 对上述前沿问题有持续热情,具备独立思考能力和系统性研究思维,敢于挑战现有范式,能够独立应用技术解决复杂问题。
- 在上述方向有过相关的科研或项目经历,在顶级会议上发表过相关论文,有深度学习,大模型等相关经验。 加分项:
- 曾发表顶级会议论文并具有一定的学术影响力,包括但不限于:NeurIPS、ICML、ICLR、ACL、TPAMI等国际顶级计算机会议/期刊。
- 拥有知名开源项目,在开源社区具有较好的影响力,或在竞赛中获得引领性的研究成果。