岗位职责
- 跟进和研发大规模语言模型(LLM)的预训练、持续训练、SFT、RLHF 等技术。
- 研发基于大模型的生成式召回、广告点击率预估、用户搜索词理解等下游应用。
- 结合以上方向的探索和研究,撰写发表论文,和业界、学术界保持良好的交流。
职位要求
- 自然语言处理、机器学习、数据挖掘、人工智能等相关专业的硕士生/博士生;
- 熟练掌握Tensorflow、Pytorch等深度学习框架,扎实的编程基础,具备独立的算法实现能力;
- 有LLM实操经验,参与过大模型预训练,SFT,RLHF等项目者优先;
- 良好的逻辑分析能力和数理基础,对算法原理及应用有较深入的理解,在人工智能相关的各类国际顶级会议/期刊中发表过论文者优先。