招聘中 社招

端侧多模态推理引擎高性能优化工程师-AML(上海/杭州/广州/深圳)

字节跳动

  • 上海
  • 机器学习

收录时间

岗位职责

  1. 负责开发和优化字节跳动公司级的端侧AI推理框架,通过CPU/GPU/DSP/NPU的并行计算优化、架构设计、稀疏优化、异构调度等多种高性能优化技术打造业界领先的高性能异构AI推理引擎;
  2. 负责将LLM、多模态、AIGC等大模型算法在端侧做AI推理技术优化,落地到抖音、剪映、火山引擎等产品,支撑字节跳动AI业务的发展;
  3. 负责AI模型和推理框架工具链开发及技术生态的建设。

职位要求

  1. 本科及以上学历,计算机/电子/信息/通信/自动化/软件等相关专业,有AI工程优化经验优先;
  2. 精通C/C++,精通算法与数据结构,熟悉Python;
  3. 熟悉主流LLM/VLM/AIGC算法模型原理,了解混合专家(MoE)架构、低比特量化(如INT8/INT4/INT2)、SparseAttention等模型优化手段,有相关优化经验者优先;
  4. 具备CUDA/OpenCL/Metal中的至少1种GPU优化经验,熟悉TensorRT/Triton/CUTLASS,熟悉高通/MTK等NPU架构及部署方案,有丰富的ARM NEON汇编优化,有以上技术的AI工程优化部署经验者优先;
  5. 熟练掌握GPU(NVIDIA/Adreno/Mali/Apple)、CPU(ARM/x86)中的1个或多个平台的高性能计算优化技术,深入理解计算机体系结构,熟悉移动端/PC端/车端中一个或多个平台的并行计算优化、访存优化等;
  6. 熟悉常用深度学习推理计算库,例如Llama.cpp、MNN、TNN、CoreML等,熟悉计算密集型算子如FlashAttention、Conv2d、GEMM、GEMV实现和加速优先。

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

字节跳动端侧多模态推理引擎高性能优化工程师-AML(上海/杭州/广州/深圳)

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看端侧多模态推理引擎高性能优化工程师-AML(上海/杭州/广州/深圳)正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位端侧多模态推理引擎高性能优化工程师-AML(上海/杭州/广州/深圳)字节跳动 · 上海

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏端侧多模态推理引擎高性能优化工程师-AML(上海/杭州/广州/深圳)正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

字节跳动端侧多模态推理引擎高性能优化工程师-AML(上海/杭州/广州/深圳)社招 · 上海

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入端侧多模态推理引擎高性能优化工程师-AML(上海/杭州/广州/深圳)内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。