岗位职责
- 跟进和研发大规模语言模型(LLM)的预训练、持续训练、SFT、RL等算法技术。
- 深度探索大模型对复杂问题的推理能力、规划能力和工具应用能力。
- 研发基于大模型的对话式导购助手、检索增强、商品信息生成等下游应用。
- 结合以上方向的探索和研究,撰写发表论文,和业界、学术界保持良好的交流。
职位要求
- 专业不限,自然语言处理、机器学习、数据挖掘、人工智能等相关专业优先。
- 熟练掌握TENSORFLOW、PYTORCH等深度学习框架,扎实的编程基础,具备独立的算法实现能力。
- 有LLM实操经验,参与过大模型预训练,SFT,RL等项目者优先。
- 良好的逻辑分析能力和数理基础,对算法原理及应用有较深入的理解,在人工智能相关的各类国际顶级会议/期刊中发表过论文者优先。