岗位职责
- 负责具身智能相关模型(多模态感知、任务规划、动作策略等)在云侧与端侧的推理性能优化与落地;
- 运用性能分析工具对推理全链路做剖析,定位性能瓶颈,提出优化方案并通过实验验证效果;
- 通过量化、剪枝、蒸馏、算子融合、编译优化、显存与调度优化等手段,将硬件算力发挥到极致,持续降延迟、提吞吐、控功耗;
- 搭建高效稳定的推理服务架构,保障多机器人并发访问下的实时性与稳定性,并支持模型在不同算力平台与传感器配置下的适配;
- 建设推理链路的监控、异常检测与灰度发布机制,保障线上问题可复现、可归因、可快速回滚;
- 与算法、硬件、评测及业务团队协作,打通模型从实验室到真实场景的落地链路。
职位要求
- 本科及以上学历,计算机/电子/自动化/软件等相关专业,有 AI 工程优化经验优先;
- 熟练掌握 C++/Python,熟悉 PyTorch,具备良好的工程化与调试能力,了解 Go 者更佳;
- 了解深度学习算法基本原理,熟悉主流推理框架与工具链(TensorRT、vLLM、SGLang、ONNX Runtime、TVM 或其他 AI 芯片配套推理栈等),理解其优化原理;
- 熟悉 GPU/NPU 高性能编程与体系结构,有 CUDA 或其他 AI 芯片工具链开发经验者优先;
- 理解机器人系统对实时性、安全性与工程鲁棒性的要求,有良好的跨团队协作能力。