岗位职责
- 聚焦于视频特效场景下的多模态大模型理解与应用探索,推动大模型能力在视频特效理解、智能化美颜及智能创作辅助等核心业务场景的落地;
- 负责模型方案设计、训练数据生产、评测体系建设及实验验证分析;
- 跟踪计算机视觉与多模态理解领域前沿技术,推动算法能力产品化落地,或产出高质量论文、专利及业务成果。
职位要求
- 人工智能、计算机、模式识别、自动化、数学、统计学等相关专业,本科及以上学历;
- 熟悉计算机视觉与深度学习基础,掌握 CNN、Transformer、CLIP、vLLM等相关技术原理;
- 熟悉图像/视频理解任务,具备等至少一个方向的项目或研究经验;
- 熟练掌握常用的深度学习模型结构及训练方法,熟练使用Claude Code/Codex等AI工具;
- 对短视频内容理解、视觉特效和美颜美妆有浓厚兴趣,具备良好的学习能力、沟通能力与团队协作意识。 加分项:
- 有人像解析、美颜/妆容识别、视频特效识别或短视频内容理解经验;
- 有多模态大模型、视觉语言模型微调或大规模图文/视频数据处理经验;
- 有移动端模型轻量化和实际部署落地经验;
- 在 CVPR、ICCV、ECCV、AAAI、ACM MM、TPAMI 等会议或期刊发表论文,或有高质量开源项目贡献。