岗位职责
-从事多模态大模型(视觉-语言、音频-语言、跨模态生成等)的算法研究与工程实现 -探索多模态理解与生成能力的提升方法,包括图文对齐、跨模态检索、多模态推理等 -结合最新多模态大模型进展,推动技术快速迭代 -设计高质量多模态训练数据方案与评估体系 -紧跟多模态前沿研究,将论文成果高效转化为工程实践
职位要求
-本科及以上学历,计算机、人工智能等相关专业优先 -扎实的深度学习基础,熟悉Transformer、ViT、CLIP等多模态模型结构 -熟练掌握Python及深度学习框架(PyTorch/PaddlePaddle) -有多模态学习、计算机视觉或NLP相关研究/项目经历者优先 -在顶级学术会议(CVPR、ECCV、ACL等)发表过论文者优先