岗位职责
- 了解多模态内容生成相关算法,如Diffusion Models 、 GAN 、 VAE 、 Autoregressive Models等,包括但不限文本/图像/视频生成,解决生成质量、多样性、可控性、采样效率、可编辑等问题;
- 了解端到端多模态生成式大模型的框架设计、训练与调优,构建基于生成模型的AI系统,推动多模态AIGC在快手各业务场景的产品化落地。
职位要求
- 硕士及以上学历,计算机、数学或统计学相关专业;
- 对基于图像、视频、语音、文本等模态内容的各类算法有一定的理解,并在如下一个或多个相关方向有相关研究经历: GAN 、扩散模型、图像生成、多模态等;
- 具备扎实的编程功底,熟悉 Pytorch 等主流深度学习框架,熟练使用 C ++/ Python 等至少一种编程语言,熟悉 Linux 开发环境;
- 对学术前沿有浓厚兴趣,时刻跟进技术前沿,并善于利用各类技术解决复杂的实际问题,有良好的沟通表达能力。