部门介绍
字节跳动基础设施计算团队,专注构建面向大模型与 AI Agent 时代的 AI-Native Infra。我们从算力、系统到平台,围绕“AI 如何高效运行、持续进化、规模化落地”这一核心问题,重构计算基础设施。我们管理着数十万台服务器组成的超大规模集群,构建统一的异构算力调度与云原生运行体系;通过软硬协同与自研框架,持续突破大模型训练与推理的性能瓶颈;并进一步向上,打造企业级 AI Agent Infra,让 Agent 具备身份、权限、记忆、观测与治理能力,真正成为可运行在生产环境中的新型“应用形态”。 从云服务器、容器、函数,到 AI 网关、可观测与弹性体系,我们构建的是一个为 AI 而生、由 AI 驱动进化的基础设施平台,支撑集团核心业务与企业级客户的智能化升级。 如果你希望参与定义 AI 时代的 Infra 范式,而不仅是优化一个模块或服务——欢迎加入我们,一起构建下一代 AI 云原生基础设施。
- 参与火山引擎观测下一代观测数据湖(Metrics、Event、Log、Trace)的存储引擎设计和开发;
- 负责/参与引擎相关的设计、实现、测试、优化、集成等工作;
- 构建高吞吐,低延迟,高容错存储引擎,分析系统性能瓶颈,打造极致系统;
- 跟踪数据库前沿技术,挖掘/落地新技术的机会。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 熟练掌握C++/Java(至少一种),多线程/多进程高并发编程,具备存储组件研发、问题排查与性能调优实战经验;
- 熟悉数据库存储引擎或者分布式存储相关模块设计实现,例如ClickHouse、Doris、HBase、Kudu、Etcd等;
- 熟悉分布式存储的原理(如LSM树、选主、存算分离、多副本复制、WAL等),对KV或列式存储格式,RocksDB/Parquet/ORC/Lance的原理有了解加分;
- 曾参与或主导过主流开源系统/企业级系统存储引擎设计开发经验者优先。