岗位职责
负责多模态大模型的研发、调优和应用,包括但不限于文本/图像/视频理解和生成,将大模型能力在公司核心业务场景中应用落地,如智能化特效、AIGC创意生成等。
职位要求
- 有扎实的计算机基础知识和编程功底,具备较强的编码能力,熟练使用 Python编程语言,熟悉 Linux 开发环境;
- 熟悉计算机视觉、多模态大模型领域的主流算法,包括但不限于DiT、GAN、VLM等;
- 熟悉深度学习框架,对主流生成式模型和大语言模型(如SD/SDXL、Flux、QWen等)有实际微调和应用经验;
- 善于利用各类技术解决复杂的实际问题,有良好的沟通表达能力;
- 在CVPR、ICCV、ECCV、TPAMI等视觉/机器学习会议或期刊发表过论文优先。