岗位职责
- 研究大语言模型可解释性,通过超大规模的稀疏字典学习,理解模型内部的神经元和神经回路;
- 研究高阶神经元、神经回路对模型影响的基本机制,包括但不限于:推理、性格、情绪、角色扮演;
- 探索和实践基于激活工程的大模型训练和评估新范式。
职位要求
- 在机器学习、语言模型、多模态、强化学习等一个或多个领域有较深入的研究经验。主导过有影响力的项目或论文者优先;
- 具有优秀的代码能力、数据结构和基础算法功底,熟练C/C++或Python;
- 好奇心驱动,具有出色的分析与解决问题的能力,具备自主探索解决方案的能力;
- 具有良好的沟通协作能力,对技术研发有强烈热情,工作积极主动,能够与团队融洽合作,共同探索新技术并快速试验想法,推进技术进步。