岗位职责
- 负责多模态大模型训练、对齐相关工作,包括不限于数据迭代、模型训练、模型评估;
- 结合实际场景,提供全面的技术解决方案,参与PE、推理优化、数据飞轮建设,提升多模态大模型在应用场景的效果;
- 协助开发和优化多模态AI Agent 的数据采集、分析及数据闭环相关工具,支持标注工具、研发工具、数据分析与可视化系统的设计与实现,提升产研团队的工作效率;
- 探索高表现力/低延迟的语音、视觉驱动的对话系统;
- 探索相关领域前沿进展,并结合产品对算法进行优化,使相关产品效果达到业界领先水平;
- 探索AI能力的极限,并赋能产品以创造价值。
职位要求
- 硕士及以上学历,计算机、电子信息、自动化、数学等相关专业,多模态大模型、计算机视觉等相关方向;
- 具备丰富的多模态理解、计算机视觉、或强化学习算法经验,对多模态大模型、计算机视觉、或强化学习算法有深入理解;
- 扎实的编程基础,对数据结构、算法设计基础有深度了解,熟练掌握Python/C++等主流语言一种或多种,熟练应用pytorch、megatron、deepspeed、huggingface、transformers等深度学习框架和库;
- 具备扎实的工程/算法能力,能迅速迁移过往的工程/算法经验,深入理解系统底层原理并进行系统优化,能快速学习新知识;
- 在CVPR / ICCV / ECCV / NeurIPS / ICLR / ICML等顶会发表过多模态大模型或计算机视觉方向高水平论文,或以主力身份参加相关领域主流算法竞赛且取得优秀成绩者优先;
- 在ACM/ICPC、CodeForces、IOI/NOI/NOIP/CSP等编程算法竞赛中获得优秀成绩者优先。