岗位职责
- 负责基础网络运营及运维工具、自动化编排平台、监控告警系统的架构设计与核心代码编写,支撑高并发、高可用网络工具的落地;
- 能够独立完成复杂项目的需求梳理、核心架构设计以及功能落地实现与交付,将网络业务痛点转化为清晰的工程技术方案并主导推进。
- 解决研发过程中的关键技术难题,参与制定、推行与拥护代码规范、接口标准及自动化测试流程,促进团队整体的工程素养提升;
- 理解网络运维、配置管理、故障定位等核心业务痛点,将资深经验抽象为工具逻辑;作为技术骨干,指导初中级工程师成长;
- 及时响应与处理线上故障;
- 配合网络变更及产品发布;
- 具备优秀的沟通理解能力与协作能力,能和团队内外同事顺畅对接,具备良好的跨团队协同和自驱力;
- 接受领导布置的其他工作任务。
职位要求
- 3年及以上B/S架构工具平台或系统的独立设计、开发和运维经验;
- 能对业务原始需求进行萃取分析,拆解模块和设计合理抽象与行为模式;
- 熟练运用设计模式、控制与管理系统复杂度;
- 熟悉常见的架构高可用方法方案,拥有大型系统的故障定位和处置经验;
- 具备扎实的 Python 编程基础,熟悉异步编程(Asyncio),精通至少一种 Web 框架(如 Django、FastAPI);
- 熟练掌握 Go 语言并发编程、通道(Channel)、内存管理及性能调优,熟悉至少一种主流框架(如 Gin、Go-Zero);
- 熟练掌握 HTML5/CSS3/TS,至少精通一种主流前端框架(React 或 Vue),具备独立开发复杂后台管理看板或拓扑可视化组件的能力;
- 熟练使用 MySQL/PostgreSQL/MongoDB/Nebula/ClickHouse等常见数据库,以及Flink、Spark/Hive等数据处理框架;
- 熟练使用Redis、Kafka、RabbitMQ 等中间件框架;
- 3年及以上园区网络或数据中心网络的网络架构设计或网络运维经历;
- 必须具备 CCIE 路由交换/园区/数据中心网络等方向的专家级认证 (或其他同级别认证如HCIE等),能熟练操作主流网络厂商的网络设备;
- 熟练掌握 SNMP、NETCONF、RESTful、gRPC 等网络管理协议或 API,熟悉 YANG 模型。有利用这些协议进行多厂商设备数据采集、状态监控或配置变更的实际开发与封装经验;
- 扎实的计算机网络原理基础,深入理解 TCP/IP 协议栈、经典路由协议等。能够看懂并理解复杂的网络业务拓扑; 加分项
- 拥有大型网络监控系统的研发与运维管理经验者优先;
- 拥有将AI Agent技术引入网络故障诊断、流量分析、自动化干预闭环等实际业务场景经验者优先;
- 熟悉 Linux 系统深度运维、有云原生(Docker、Kubernetes、CI/CD 流水线)大规模落地经验者优先;
- 具有良好的一致性与稳定性交付意识,在配置防漂移、自动化测试领域有成熟方法论者优先;
- 熟悉DPDK和P4等面向数据平面的编程技术,熟悉VRR、Quagga、GoBgp等开源控制平面工具的集成方案者优先。