岗位职责
- 探索模型在预训练阶段与后训练阶段的内在一致性,跨训练阶段预测模型性能上限;
- 探索从可解释性角度提出更多更深入的基于模型内在机理的评测标准;
- 提出更好的Benchmark,定义模型能力,定义AGI;
- 从评测角度对模型进行Red Teaming,找到模型的短板并针对性提出模型改进;
- 探索全新的模型和智能应用,如Agent Foundation Model,DeepResearch,需要的评测基准。
职位要求
- 聚焦问题本质,从第一性原理思考问题;
- 对模型评测和定义AGI充满兴趣;
- 有大模型训练或模型评估研究经验,和相关论文优先。