岗位职责
- 进行AI Infra相关的研发工作,包括但不限于模型推理引擎,模型后训练,算法模型压缩,模型部署等;
- 通过AI Infra的研发工作,支持LLM和多模态等业务大模型的研发、部署和上线服务,支持Agentic AI等新型AI产品的研发和应用,提高计算效率,实现业务落地和成本降低等目标;
- 与算法、工程、产品以及运营等团队通力合作,推进AI应用产品(AI Agent)的研发和落地应用。
职位要求
- 至少熟悉一种编程语言,包括但不限于C/C++/Python/Rust/Java等,熟悉Linux/Unix开发环境;
- 对AI技术和算法模型感兴趣,熟悉主流的算法模型,包括LLM大语言模型、多模态模型、cv生成类模型等,有算法背景或者算法模型压缩经验者优先;
- 对计算机系统和高性能计算感兴趣,有计算机系统相关的知识,包括计算机网络、操作系统、计算机体系结构、数据库等,有Nvidia GPU和其他AI芯片相关经验者优先;
- 了解业界主要的推理框架和模型后训练框架,包括但不限于vLLM,SGLang,PyTorch,Megatron,verl等;
- 对模型部署和服务感兴趣,熟悉k8s、Docker、Ray等技术者优先;
- 具备良好的团队合作意识,能高效进行跨部门沟通协调。