岗位职责
- 研发行业领先且实用的AIGC视觉生成大模型技术,包括AIGC视觉生成大模型、文生图、图生图、保ID的可控编辑、图文/视频多模态理解及生成技术落地;
- 构建完整的AIGC视觉生成系统链路,推动在快手创作/消费/搜索/商业化/AI生产工具等场景的规模应用,实现AIGC关键技术突破、极致打磨效果体验,在各业务场景创作用户价值;
- 负责AIGC技术及产品效果创新,持续打造业界的技术口碑及影响力。
职位要求
- 在计算机视觉、多模态一个或多个领域的研究和实践经验,包括但不限于以下方向:视觉生成(如文生图、图生图、图像/视频生成与编辑)、多模态GPT、Diffusion模型、大规模训练、RLHF;
- 有通用图像视频生成模型、大语言模型、AIGC创新产品实战落地经验者优先;
- 顶会/期刊论文者优先,如CVPR/ECCV/ICCV/NeurIPS/ICLR/SIGGRAPH、PAMI/IJCV等,在重要算法比赛中取得过优秀名次的候选人优先;扎实的编程功底,熟悉 PyTorch 等主流深度学习框架,熟练使用 C++/ Python编程、Linux 开发环境;
- 对技术前沿有浓厚兴趣,善于利用各类技术解决复杂实际问题,强烈的自驱力,良好沟通表达及的团队协作能力。