岗位职责
- 参与电商多模态大模型(MLLMs)的持续预训练和指令微调(SFT),开发精准的商品图谱、用户意图理解、跨模态检索等核心能力,赋能搜索、推荐等业务;
- 负责多模态生成算法(如Diffusion Models, VAEs等)的研发与创新,致力于解决生成内容的质量、多样性、可控性、可编辑性及采样效率等前沿问题;
- 基于大模型构建文本/图像/视频多模态创作引擎,并推动其在电商业务场景的产品化落地,包括但不限于背景替换、虚拟试衣、图生视频、海报生成等创新应用;
- 通过DPO/PPO等强化学习算法,迭代Reward Model以指导多模态素材生成,引导模型生成更符合人类偏好、审美标准及业务目标的多模态内容,最终提升用户体验和商品转化率。
职位要求
- 在计算机视觉、多模态学习、深度学习等一个或多个领域有深入研究,包括但不限于:扩散模型(Diffusion Models)、图像/视频生成、检测与分割、多模态内容理解等;
- 对主流生成模型(如Stable Diffusion, DiT, Flux, VAEs等)有深入的理解和有实际落地经验者优先;
- 在顶级学术会议或期刊(如CVPR, ICCV, ECCV, NeurIPS, ICLR等)发表过相关论文者优先;
- 对技术前沿有浓厚兴趣,能主动跟进并解决复杂问题;具备良好的沟通能力和团队协作精神,主观能动性强。