岗位职责
- 负责深度学习推理引擎基础建设,包括架构设计、系统开发、高性能优化;
- 负责PyTorch/TensorFlow的社区跟进、性能改进、功能扩展、故障分析;
- 负责支持各算法业务线,在工程上的优化,沉淀最佳实践,并推广到全公司。
- 负责LLM推理引擎的部署与服务化封装,覆盖推理全链路优化机制的工程落地与性能调优。
职位要求
- 有3年以上C++/Python研发经验,具备高并发或分布式系统的设计与实现能力;
- 深入掌握PyTorch/TensorFlow核心机制,有实际工程开发与源码级调试经验;
- 熟悉至少一种主流LLM推理框架(vLLM/SGLang/TensorRT-LLM),理解其调度器、内存管理器、执行引擎的设计原理。 加分项
- 有搜索/推荐/广告/NLP/图像/语音背景者优先;
- 熟悉主流大数据生态(如:Hadoop/Spark/Flink)、有操作系统内核开发应用经验者优先;
- 有GPU编程经验,熟练使用CUDA或OpenCL编程者优先;
- 熟悉主流LLM推理框架(vLLM/SGLang/TensorRT-LLM/LMDeploy等),有实际部署、性能调优或二次开发经验者优先;
- 有针对高复杂度算法的优化经验(比如机器学习算法/图像处理算法)优先;
- 对TensorFlow/PyTorch本身架构及相关社区有深入理解或有开源贡献者优先。