岗位职责
- 参与剪映系产品涉及的关键算法模型的工程部署和推理优化,落地行业中一些推理加速方法、工具等;
- 参与剪映系GPU资源优化,建设GPU管理系统在不同Infra平台上管理不同模型的GPU资源,与Infra团队协作,提升整体剪映系GPU利用率。
职位要求
- 本科及以上学历,计算机相关专业;
- 熟练掌握C++/Golang,精通数据结构与算法,有并发编程基础;
- 有服务端工程研发和维护经验,有较好的服务端架构优化经验;
- 具备扎实的GPU编程基础,包括CUDA,Trtion,Cutlass等,熟悉大模型网络架构和和算子实现细节,有丰富的模型和算子性能调优实战经验;
- 具有Diffusion/DiT类AIGC模型的工程化和推理加速经验,熟悉PyTorch,熟悉xDiT/LightX2V等DiT推理框架及常用DiT推理加速技术;
- 熟悉大模型的模型量化、剪枝、蒸馏等模型压缩技术。 加分项:
- 熟悉PyTorch/TensorFlow或其他主流深度学习技术框架;
- 具有AIGC模型训练/推理优化经验,熟悉TensorRT-LLM、VLLM等LLM推理效率优化工具者优先。