岗位职责
- 为视觉生成模型构建高质量训练数据,兼顾多模态理解与生成相关工作,优化视觉生成模型的数据构建 Pipeline,为模型性能提升提供可靠的数据支撑;
- 设计并落地数据有效性验证方案,验证数据对视觉生成模型训练的实际作用,探索数据在模型训练中的有效性;
- 在顶会顶刊上发表研究成果和开源代码,提升团队在多模态视频生成等领域的学术声望。
职位要求
- 硕士及以上学历(在校生优先),计算机、人工智能、计算机视觉、数学等相关专业,具备多模态理解、视觉生成相关基础;
- 熟悉视频生成基础模型如SVD、Sora、Meta Moviegen、Hunyun Video等;
- 熟悉多模态大语言模型(例如Deepseek/Qwen等)、多模态理解生成、世界模型。 加分项:
- 有多模态大语言模型、图像/视频生成大规模训练和数据构建经验者优先;
- 学习能力强、自驱、代码能力强、善于解决问题者优先;
- 有一作顶会或顶刊论文发表经历或相关知名大模型开源项目者优先。