岗位职责
- 参与生成式数字人(多模态及AIGC方向)和驱动算法研究和探索;
- 能够快速定位问题并给出有效的解决方案,实现算法落地,满足业务场景需要,打磨技术降低成本;
- 跟踪Generative AI前沿技术及应用落地 。
职位要求
- 人工智能、计算机、模式识别等相关专业,本科及以上学历;
- 扎实的理论基础和深厚的工程实践能力,在语音与视觉多模态融合、人像生成等方面有一定经验,深入理解数字人生成算法(如GAN、Diffusion、AR、3DMM等)及其在语音驱动视觉方向的应用;
- 熟悉计算机视觉与图像处理技术,掌握面部表情识别与合成、动作捕捉与合成、3D人体姿态估计等相关技术,在talking head生成、人物动作生成、人物表情驱动等多个领域有深入研究;
- 精通深度学习框架(如TensorFlow、PyTorch等),具备基于深度学习的语音与视觉多模态融合的开发经验;
- 在国际顶会或期刊(包括但不限于SIGGRAPH,CVPR,NeurIPS,ICCV,ECCV等)上发表过论文者优先。