岗位职责
- 以代码守护业务稳定性,设计并实现全链路高可用方案,涵盖混沌工程、故障自愈、自动化演练及智能故障定位,确保亿级用户产品的持续可用;
- 开发端到端的运维解决方案,包括持续交付(CI/CD)、容量管理、自动化弹性伸缩、流量调度及性能优化;
- 基于云原生架构,建设涵盖变更发布、容器调度(K8S)及网络虚拟化(SDN/VPC)的云上运维平台,通过工具创新和架构升级提升系统的运维可靠性。
- 站在全站高度与用户视角,不断完善底层基础设施对产品体验的支撑能力,通过极致的性能调优影响并受益于亿万消费者。
职位要求
- 熟悉C/C++/Java/golang等至少一种编程语言,和shell/perl/python等至少一种脚本语言;
- 熟悉Linux或Unix操作系统,熟悉TCP/IP协议栈,有LINUX高性能网络服务器的编程经验,如IO处理、多线程。底层基础知识扎实;
- 包括不限于以下方向: 虚拟化技术,也包括阿里云的SDN、VPC等网络虚拟化、存储虚拟化技术,容器技术、数据库技术,包括MySQL、PostgrelSQL、MongoDB、Redis、HBase、Memcache等开源数据库。 互联网安全技术、分布式技术,容灾多活等;
- 有广泛的技术视野,具备很强的学习能力、分析能力和解决方案设计能力;
- 逻辑思维清晰,学习能力强,对新事物保有好奇心,并能快速适应新环境;良好的沟通能力和团队协同能力;能与他人合作,共同完成目标;遇事沉稳,不急不躁,心理素质过硬,有担当、有韧性,表达能力强。 【加分项】
- 深刻理解数据结构和算法设计,如对概率统计基础算法,LR、RF 等基本机器学习算法有理解;
- 熟悉HTTP协议,在校期间有相关的项目经验;
- 熟练掌握K8S并有大规模应用经验;
- 喜欢钻研,如有在某个技术领域有深入的研究,对该领域的的技术现状、问题和未来发展有自己的理解和实践。