招聘中 社招

企业微信-大模型训练框架开发工程师-AI Infra(成都/北京)

WXG

  • 广州
  • 技术

收录时间

岗位职责

  1. 负责大模型训练/推理场景下的性能分析与优化,重点优化 NVIDIA GPU 及 国产芯片 的计算、显存、通信和调度瓶颈;
  2. 负责 CUDA / Triton / C++ 高性能算子开发与优化,包括 GEMM、Attention、MoE、KV Cache、通信融合等方向;
  3. 负责多卡、多机训练/推理性能调优,优化 NCCL、NVLink、NVSwitch、InfiniBand/RDMA 等通信链路;
  4. 负责基于 NVIDIA GPU 和 国产芯加速卡 的性能调优,提升 GPU 利用率、吞吐、延迟和显存效率;
  5. 负责 PyTorch、TensorRT-LLM、vLLM、SGLang、Megatron-LM 等框架下的大模型性能优化落地;
  6. 结合 Nsight Systems、Nsight Compute、CUDA Profiler 等工具进行性能分析,定位并解决性能瓶颈。

职位要求

  1. 熟悉 C/C++、CUDA 或 Triton 编程,有 GPU 算子开发或性能优化经验;
  2. 熟悉 NVIDIA GPU 架构,理解 SM、Warp、Tensor Core、Shared Memory、Memory Coalescing、Occupancy 等概念;
  3. 熟悉大模型训练或推理流程,了解 Attention、GEMM、MoE、KV Cache、并行策略等核心模块;
  4. 熟悉分布式训练/推理优化,理解 TP、PP、DP、EP、NCCL、RDMA 等技术;
  5. 有实际 profiling 和性能调优经验,能够通过工具定位瓶颈并给出优化方案;
  6. 有 NVIDIA GPU 或 国产加速卡 实际优化经验者优先;
  7. 不要求候选人覆盖 AI 全栈所有方向,只要在大模型训练/推理、GPU 算子优化、分布式通信、性能调优、推理框架等任一方向有较深入理解和实践经验,均欢迎投递。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

WXG企业微信-大模型训练框架开发工程师-AI Infra(成都/北京)

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看企业微信-大模型训练框架开发工程师-AI Infra(成都/北京)正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位企业微信-大模型训练框架开发工程师-AI Infra(成都/北京)WXG · 广州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏企业微信-大模型训练框架开发工程师-AI Infra(成都/北京)正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

WXG企业微信-大模型训练框架开发工程师-AI Infra(成都/北京)社招 · 广州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入企业微信-大模型训练框架开发工程师-AI Infra(成都/北京)内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。