岗位职责
- 负责多模态大模型GPU/CPU上训练和推理平台的开发和维护,提升平台整体的运行效率和稳定性;
- 参与多模态大模型的整体系统架构设计,包括数据流、计算图、分布式训练与推理框架;
- 负责大模型的业务探索,与相关团队紧密配合,将多模态模型落地到具体业务场景,提升业务收益。
职位要求
- 具备扎实程序设计能力,熟悉c++语言,掌握java/python语言。有c++高性能计算项目开发经验;
- 熟悉深度学习原理与多模态模型结构(CLIP、BLIP、LLaVA、MMGPT 等);
- 精通至少一种深度学习框架(PyTorch优先);
- 熟悉分布式训练与推理优化技术(如DeepSpeed、Megatron、TensorRT、ONNX Runtime);
- 具备良好的系统工程能力(微服务、容器化、CI/CD、云原生架构等);
- 有较好的沟通和协作能力。 加分项
- 有大规模多模态数据处理与数据增强经验;
- 参与过开源多模态模型的开发或贡献(如 HuggingFace、OpenMMLab 等);
- 熟悉 GPU 编程(CUDA)优化;
- 有多模态检索、理解、生成相关落地产品的经验。