已下线 社招

OceanBase-Maas研发工程师/大模型研发工程师-OceanBase

OceanBase

  • 北京、杭州
  • 技术类-开发

收录时间

已下线 · 历史岗位确认下线时间:。以下为收录时的信息,不代表当前仍可申请。查看历史岗位档案

岗位职责

  1. 负责MaaS平台的整体架构设计,支持Chat、Embedding、Rerank等多种类型模型的高效托管与服务化。设计并实现智能模型路由(Model Router)机制,支持多模型版本灰度、AB测试、基于负载/成本/延迟的动态调度。
  2. 异构GPU集群管理: 负责模型服务在K8s环境下的自动化部署、扩缩容及生命周期管理。实现GPU池化,屏蔽异构GPU的差异。
  3. 推理性能优化:针对不同规格 GPU进行推理参数调优,实现算力资源的最优配置。深度优化vLLM、SGLang等主流推理框架,提升模型吞吐量(Throughput)并降低首字延迟(TTFT)。
  4. 服务治理与高可用:设计并实现针对推理场景的负载均衡策略,构建全方位的监控告警体系,覆盖 GPU 利用率、KV Cache 占用、Token 速率及 API 成功率等。

职位要求

  1. 基础能力:具备扎实的数据结构、算法及多线程/协程开发能力。
  2. 云原生与基础设施: 熟悉 Docker、了解 K8s Operator 或调度器扩展者优先。
  3. 推理框架经验:理解Transformer原理,熟悉TP/PP/EP/DP等并行推理技术,有vLLM、SGLang、NVIDIA TensorRT-LLM实际生产环境应用或二次开发经验者优先。
  4. 综合素质:对大模型技术栈(RAG、Agent)有热情,关注领域内论文。具备良好的系统化思维,能从监控数据中定位性能瓶颈。 加分项
  5. 有自研过模型路由层(Router)或 Gateway 经验,支持 Token 级流控与计费。
  6. 熟悉分布式推理(Tensor Parallelism / Pipeline Parallelism)。
  7. 有Embedding模型生产环境大规模优化经验

相似岗位

有些机会,只在官网短暂出现

真正值得关注的岗位,常常只在企业官网短暂开放,可能两三天后就下线,也未必会同步到综合招聘平台。没有持续关注,你甚至不会知道它曾经出现。职先机持续聚合并核验官网岗位,帮你抓住职场先机,快人一步。

微信小程序 / 当前岗位

在微信里继续看这个岗位

OceanBaseOceanBase-Maas研发工程师/大模型研发工程师-OceanBase

扫码直达当前岗位收藏、浏览记录和下线提醒留在微信里
电脑端可直接微信扫码;手机端可保存小程序码后在微信中识别。
微信扫码在职先机小程序查看OceanBase-Maas研发工程师/大模型研发工程师-OceanBase正在准备岗位码
职先机微信小程序一岗一码 · 正式版直达保存小程序码

岗位提醒 · 01

收藏历史岗位,保留参考信息

当前岗位OceanBase-Maas研发工程师/大模型研发工程师-OceanBaseOceanBase · 北京、杭州

01

扫码进入当前岗位无需重新搜索,直接打开当前岗位详情。

02

收藏历史岗位此岗位已经下线,收藏仅用于保存历史参考。

03

继续查看相似机会原岗位变化时,可继续浏览相关在招岗位。

职先机会持续核验公开岗位;岗位状态与最终招聘结果仍以企业招聘官网为准。

微信小程序扫码打开当前岗位

扫码查看并收藏历史岗位,不代表当前仍可申请。

微信扫码在职先机小程序收藏OceanBase-Maas研发工程师/大模型研发工程师-OceanBase正在准备岗位码

微信小程序 · 当前岗位

请前往微信小程序提交内推申请

OceanBaseOceanBase-Maas研发工程师/大模型研发工程师-OceanBase社招 · 北京、杭州

01进入当前岗位扫码或打开后直达本岗位内推申请页。

02提交 PDF 简历简历替换、处理进度和消息提醒在小程序内同步。

手机端将尝试直接打开微信;电脑端请使用微信扫码。

微信扫码进入OceanBase-Maas研发工程师/大模型研发工程师-OceanBase内推申请页正在准备岗位码
当前岗位专属码扫码后无需重新搜索岗位保存小程序码

内推提示

暂不支持该岗位内推

如需投递,建议前往官网进行投递。