部门介绍
我们团队研发尖端云安全解决方案,为字节跳动及企业客户提供规模化安全防护。 依托安全部门深厚的技术积累,以及对客户安全需求的深刻理解,我们借助领先技术与产品,通过全方位智能防御体系应对各类实际安全挑战。 我们的工作确保云环境始终安全、可靠,为整个组织的创新实践提供有力支撑。
- 我们正在寻找AI Infra研发工程师,负责在丰富业务场景中围绕大模型推理全链路,结合云原生架构与推理引擎优化,打造高性能、高可靠的AICC机密推理基础设施,为火山引擎大规模AI算力平台提供底层技术支撑;
- 推理引擎适配优化:负责大模型推理引擎在可信环境下的适配与性能优化,涵盖批处理并行策略、显存管理、KV Cache调度及算子层优化等方向,深度挖掘并解决性能瓶颈,提升机密推理场景下的资源利用率;
- 云原生部署体系:基于Kubernetes构建推理工作负载的高效部署与编排体系,设计智能路由调度策略与弹性伸缩机制,支撑大规模GPU集群上的机密推理服务,同时实现与云原生资源调度、镜像分发、存储网络、监控可观测性等底层平台的对接与协同整合;
- 工程效率与稳定性:建设面向可信AI Infra的CI/CD流水线、自动化测试与运维体系,结合Agent探索AIOps落地应用,提升部署效率与线上稳定性,保障大规模集群的SLA。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 计算机科学、软件工程、电子工程等相关专业硕士学位及以上;
- 系统编程能力:熟练掌握Python/C++/Go/Rust中至少两门编程语言,具备扎实的系统软件设计与开发能力;
- 云原生与K8s:深入理解Kubernetes架构与核心原理,具备Operator、CRD、CSI/CNI等扩展开发经验,熟悉Helm、Argo CD等云原生工具链;
- 推理引擎经验:熟悉至少一种大模型推理框架(SGLang、vLLM等),了解KV-Cache、模型量化技术、PagedAttention等核心机制;
- 高性能系统优化:具备系统性能调优经验,熟悉CPU/GPU架构、内存层次、I/O路径等,能够定位并解决系统级性能瓶颈;对eBPF、torch.profiler、Nsight等使用熟悉者优先,有国产卡调优经验者优先;熟悉TEE等可信计算环境下相关软硬件特点优先;
- 工程落地能力:具备良好的工程素养与项目管理能力,能够独立完成从方案设计到线上落地的全流程,有分布式系统开发经验者优先。