部门介绍
字节跳动基础设施部门,负责字节跳动的全栈算力基础设施,从芯片服务器产研、到超大规模数据中心,到传统云平台和如今的AI Native Cloud,全方位为抖音、豆包、今日头条、飞书、火山引擎等各类产品提供领先、稳定的百万量级大规模算力基础设施服务。我们的领域涵盖数据中心建设、内核操作系统开发、服务器集群管理、高速网络通信、EB级数据存储体系、搜索型数据库探索、基于LLM的AI基础设施的研发调度与治理等,致力于打造业界领先的、面向LLM的AI云原生基础设施架构与产品矩阵。
- 负责在公司云数据中心海量主机集群与超大规模核心组件的自动化运维体系搭建过程中,构建标准化、自动化、可扩展的云运维基础平台与运维底座,支撑公司全球化业务规模化扩张与技术架构升级;
- 负责多云环境的数据全生命周期管理与资源运营控制面建设,统筹多厂商云资源的统一交付、调度与管控,突破异构云架构壁垒,构建业界领先的多云资源管理平台;
- 负责多云安全能力体系建设,建设安全、稳定、可靠的多云管控系统核心能力,保障多云环境下核心数据中心之间的数据传输安全,支撑公司多云战略安全合规落地;
- 负责云基础运维工作向平台化、智能化、自主化方向战略演进,打造AIOps能力,建设故障自动定位与自愈、资源弹性调度等智能运维能力,降低人工运维成本,提升整体运维管理效率、故障响应速度与问题解决能力,筑牢业务稳定运行的技术防线;
- 与云业务团队紧密合作,理解并合理抽象业务需求,参与离线与实时数据仓库的构建,参与数据治理工作,提升数据易用性及数据质量,发挥数据价值。
岗位职责
招聘官网暂未提供完整岗位职责,请前往官网核实。
职位要求
- 本科及以上学历,计算机相关专业优先,1年以上后端开发经验;
- 具备优秀的编程能力,至少掌握一门编程语言,包括但不限于Golang、Python、C++、Java等;熟悉常见的后端Web框架及其设计原理;
- 深入理解Linux操作系统,精通TCP/IP、HTTP等协议,熟悉Thrift、gRPC、bRPC通信框架中的一种;
- 熟悉常见的消息中间件与存储软件,包括但不限于Redis、MySQL、Kafka、RocketMQ等;
- 具备良好的自驱力与学习能力,优秀的沟通能力、组织协调与项目推动能力;英语可作为工作语言者优先。