岗位职责
- 参与原生多模态大模型研发,包括MoE多模态架构、多模态强化学习框架、多模态长思维链推理能力优化、高质量数据合成、体验优化等。
- 负责原生多模态大模型高效率预训练,以及后训练探索,支撑多模态输入/输出、复杂任务均衡优化。
职位要求
- 硕士及以上学历,计算机视觉、语音、模式识别、计算机科学或数学相关专业背景;
- 具备扎实的代码基础,熟练掌握Python/Tensorflow/PyTorch等;
- 具备较强的团队合作能力和沟通能力; 加分项:
- 在多模态/语言大模型、计算机视觉领域在国际顶级会议/期刊发表过高质量论文。
- 有数学、代码类等大模型优化经验优先
- 大模型分布式训练、AI Infra等领域有科研或实践经历。