岗位职责
- 负责中长视频多模态理解能力建设:创作场景需要对用户素材充分理解,因此大模型需要对输入视频的画面、声音及语音等能充分理解,具备素材剪辑处理的通用理解能力;
- 负责创作领域专业Agentic Model的数据、训练等工作:对于营销、UGC、PGC等不同创作场景,模型需要具备优质视频创作知识储备,能基于原子能力Tools规划合理的Action Sequence完成创作。
职位要求
- 本科及以上学历,计算机视觉、人工智能、大模型等相关专业优先;
- 有LLM/MLLM等多模态理解技术背景、或大规模模型训练实际项目经验;
- 有图像视频生成与可控编辑、多模态、AIGC、数字人应用项目落地经验者加分;
- 在TPAMI/CVPR/NeurIPS/ICCV/ICML/ICLR等顶级期刊会议上发表相关论文者加分;
- 富有钻研与创新精神,对行业新技术充满热情,积极主动有热情,能与团队融洽合作相处、具备较强的沟通能力。