岗位职责
- 和集团内基础大模型团队紧密合作,研发多模态数据理解与处理算子,覆盖图像、视频、音频等多模态数据的识别、理解、质量评估等核心能力,以高质量合成数据驱动集团大模型实现行业领先
- 负责多模态领域专家模型的研发,负责从任务定义、数据构建、模型训练、推理优化、评测迭代到业务落地的全流程闭环,持续提升模型的泛化能力与稳定性。
- 负责全模态理解大模型的研发,持续优化模型从底层感知(时空定位、细粒度识别)到高阶认知(结构化输出、逻辑推理)的核心能力,打造业界sota。
- 探索创新的多模态/全模态大模型训练范式,撰写发表创新论文或技术报告,参与模型开源与社区建设。
职位要求
- 硕士及以上学历,计算机科学与技术、数学等相关专业优先;
- 有 2 年以上多模态大模型相关算法研发经验,熟悉常见的深度学习框架(如Tensorflow、Pytorch),有多模态大模型(VLM / MLLM / Omni)训练经验者优先;
- 熟练掌握机器学习、自然语言处理、计算机视觉、多模态大模型等相关知识,有一作顶会论文(CVPR、ICCV、ECCV、NeurIPS、ICML、ICLR、ACL、EMNLP等)或开源项目经验者优先;
- 具备扎实的工程实现能力和业务落地能力,能够将前沿算法实际落地部署,熟练使用常见的训练、推理框架,有较好的创新和开拓能力。