岗位职责
- 负责图片美化和创作Agent相关的算法和应用,研究高质量图片创作数据的挖掘和合成、图片创作策略和评估算法、Agent全链路优化方法等;
- 开展高质量数据挖掘清洗对齐、多模态数据自动合成方法、Self-Instruct等方向探索;
- 研究全模态大模型(文本、图像)的Post-training算法,探索图像多模态感知-决策-评估能力;
- 结合业务将技术落地至CapCut图片产品,触达线上海量图片创作者。
职位要求
- 优秀的代码能力、数据结构和基础算法功底,熟练掌握至少一门语言,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;
- 熟悉多模态、CV、ML、NLP等相关的技术,深入理解大模型或图片视频生成等相关技术栈(如RLHF、SFT、Dit/ViT/Transformer等);
- 在大模型领域,主导过大影响力的项目或论文者优先;在ACL/EMNLP/ECCV/CVPR等顶会发表论文者优先;
- 有图片/视频生成大模型、理解/生成/编辑统一大模型开发训练经验优先;
- 出色的问题分析和解决能力,有自主探索解决方案的能力;
- 优秀的沟通协作能力,能和团队一起探索新技术,推动技术进步;优秀的心理素质与应变能力。