招聘中 社招

多模态大模型推理服务研发工程师-Data AML(北京/上海/杭州/深圳)

字节跳动

  • 北京
  • 基础架构

收录时间

岗位职责

  1. 在线推理服务开发:负责Seedance、Seedream、Seed3D等SOTA模型在线Serving系统的设计与开发,构建高并发、低延迟、高可用的推理服务,支撑多模态、视频生成等模型的线上实时推理;
  2. 推理框架研发:参与推理框架功能开发,包括请求调度、模型并行(TP/PP)、多模型混合部署等能力建设;
  3. 服务架构演进:设计并落地推理服务的核心架构,涵盖流量调度、负载均衡、弹性扩缩容等,保障大规模GPU集群上的服务稳定性;
  4. 性能与效率优化:针对端到端推理链路进行系统级优化,提升GPU利用率、提升服务吞吐;
  5. 工程质量与稳定性:主导推理服务的可观测性建设(监控、告警、链路追踪),参与线上问题诊断与专项治理,持续提升系统稳定性和运维效率。

职位要求

  1. 计算机相关专业本科及以上学历,精通Go/Python/C++中至少一门,具备良好的系统设计与编码能力;
  2. 扎实的后端开发基础:熟悉高并发服务架构设计,有RPC框架、异步并发、连接池、限流熔断等实战经验;
  3. 熟悉分布式系统核心概念:负载均衡、服务发现、消息队列、分布式缓存等,能独立设计和落地高可用服务;
  4. 具备性能分析与调优意识:熟悉Profiling工具,有系统级性能瓶颈定位和优化经验;
  5. 对大模型推理服务有浓厚兴趣,具备较强的自驱力、学习能力和跨团队协作能力。 加分项:
  6. 有大模型在线推理服务实战经验;
  7. 了解主流模型架构(Transformer/DiT/MoE)及推理优化技术;
  8. 有在线服务研发经验,处理过GPU集群调度问题;
  9. 有推理框架插件开发或模型Serving工具链建设经验。

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

字节跳动多模态大模型推理服务研发工程师-Data AML(北京/上海/杭州/深圳)

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看多模态大模型推理服务研发工程师-Data AML(北京/上海/杭州/深圳)正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏当前岗位,下线及时通知

当前岗位多模态大模型推理服务研发工程师-Data AML(北京/上海/杭州/深圳)字节跳动 · 北京

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏并开启提醒在小程序内收藏后,岗位下线或变化时及时通知。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码打开当前岗位,完成收藏并开启下线提醒。

微信扫码在职先机小程序收藏多模态大模型推理服务研发工程师-Data AML(北京/上海/杭州/深圳)正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

字节跳动多模态大模型推理服务研发工程师-Data AML(北京/上海/杭州/深圳)社招 · 北京

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入多模态大模型推理服务研发工程师-Data AML(北京/上海/杭州/深圳)内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。