岗位职责
-负责大模型训练/推理基础设施的设计与优化,包括分布式训练框架、推理引擎、模型压缩部署等 -深入优化计算效率,探索混合精度、量化(INT8/FP16)、KV Cache等技术的工程实践 -与算法团队协作,推动大模型在异构硬件(GPU/NPU)上的高效运行 -参与AI系统架构设计,提升训练和推理的吞吐量与稳定性 -关注AI Infra前沿进展,将CUDA/XLA优化、算子融合等技术应用于实际系统
职位要求
-本科及以上学历,计算机、软件工程等相关专业优先 -熟悉分布式系统与并行计算,有CUDA编程或高性能计算经验者优先 -掌握C++/Python,有深度学习框架(PyTorch/PaddlePaddle)使用经验 -理解模型量化、推理优化、显存管理等技术原理 -有大模型训练/推理系统相关项目或实习经历者优先