岗位职责
- 研发多模态大模型(MLLM)预训练对齐表征、垂域SFT、RLHF 等技术;
- 探索多模态大模型(MLLM)垂域应用,如数据飞轮治理、训测蒸馏加速、开放词汇理解 等技术;
- 研发基于大模型的图文搜索、检索增强RAG、Agent 等技术;
- 结合以上方向的探索和研究,撰写、发表论文,和业界、学术界保持良好的交流。
职位要求
- 计算机视觉、自然语言处理、机器学习、数据挖掘、人工智能等相关专业的全日制在读硕士/博士;
- 熟练掌握Tensorflow、Pytorch等深度学习框架,扎实的编程基础,具备独立的算法实现能力;
- CV、NLP、ML等基本功底,有MLLM实操经验,参与过大模型预训练,SFT,RLHF等项目者优先;
- 良好的逻辑分析能力和数理基础,对算法原理及应用有较深入的理解,在人工智能顶级会议/期刊中发表论文者优先;
- 能长时期线下实习者优先。 【加分项】
- 在高影响力的开源项目中,做出过核心贡献;
- 在国际竞赛(如:ACM ICPC, Kaggle, KDD Cup, SemEval等)中获得过优异成绩。