岗位职责
- 负责构建统一的多模态语义表示空间,研发前沿的多模态算法,解决跨模态内容对齐、细粒度特征理解与关联性建模等核心问题,为下游任务提供高质量的Embedding;
- 主导电商多模态大模型(MLLMs)的持续预训练和指令微调(SFT),开发精准的商品图谱、用户意图理解、跨模态检索等核心能力,赋能搜索、推荐等业务;
- 探索并应用强化学习技术(如DPO\GRPO等),构建精准的Reward Model,对多模态内容的深度语义、层级分类等进行建模,使其理解和判断标准更贴近人类偏好与业务目标,提升内容分发效率与转化效果。
职位要求
- 在多模态学习、计算机视觉、自然语言处理等一个或多个领域有扎实的理论基础和深入研究,包括但不限于:多模态表征学习、大模型指令微调、跨模态检索、视觉语言模型(VLMs)等;
- 对主流的多模态预训练模型(如CLIP系列, LLaVA, Qwen-VL等)有深入理解,并具备大模型SFT/RL的实际项目经验,熟悉相关训练框架(如Pytorch, Tensorflow)者优先;
- 在顶级学术会议或期刊(如CVPR, ICCV, ECCV, NeurIPS, ICLR, ACL等)发表过相关论文者优先;
- 对技术前沿有浓厚兴趣,能主动跟进并解决复杂问题;具备良好的沟通能力和团队协作精神,主观能动性强。