岗位职责
- 负责大模型可解释性技术创新和研发,探索大模型面向长程任务、极致安全治理的参数定位、机制解释、模型增强相关算法及应用落地。持续跟进前沿可解释性技术,厘清模型决策背后的神经元逻辑,推动大模型从黑盒系统向透明可解释系统转变,保持技术领先;
- 负责大模型精准学习算法创新和研发,探索LLM可解释性 + 模型增量CPT/SFT/RL算法,提升语言模型在agentic coding/多语言等专业领域上的能力;
- 将相关技术成果应用于千问模型升级、海外主权大模型业务中,显著提升千问模型服务效率和海外国家主权大模型线上效果。
职位要求
- 本科及以上学历,计算机科学、人工智能、机器学习、数学等相关专业优先;
- 对上述研究方向的某一项或者几项有完整的研究经历或者实际的工业界落地经验;
- 具备独立思考能力和系统性研究思维,具备较强的动手能力,敢于挑战现有范式,能够独立应用技术端到端解决复杂问题。 【加分项】在国际顶级会议(ICLR/NeurIPS/ICML/ACL)有论文发表;在顶级编程竞赛中获得优秀成绩;有高star的github开源项目。