岗位职责
】
- 负责Linux/Unix服务器及X86硬件平台的日常运行监控、例行巡检与健康检查,确保生产系统7×24小时稳定运行,核心设备可用性达到
- 9%以上。
- 快速响应并处理服务器硬件(CPU、内存、磁盘阵列、RAID卡、电源等)及存储(HDS、DELL、华为)的软硬件故障,主导故障排查、定位及修复,并输出详细的故障报告。
- 负责操作系统层面的性能调优(内核参数、文件系统、I/O调度,等),识别并解决系统资源瓶颈,保障半导体业务应用的流畅运行。
- 主导Linux/Unix平台的架构规划与设计,负责新服务器的OS安装、配置、基线加固及安全补丁管理。
- 负责虚拟化平台(如VMware vSphere、KVM、OpenStack,等)的日常运维、资源池管理及容量规划,提升资源利用率。
- 根据业务发展需求,评估并规划X86硬件及Unix系统的扩容、升级及技术改造方案,并推动实施落地。
- 履行7×24小时On-Call职责,负责并参与重大故障的应急处理,并对一线值班人员进行技术指导。
职位要求
】
- 计算机科学、信息技术或相关专业本科及以上学历。
- 3年以上Linux/Unix系统运维经验,2年以上X86服务器硬件维护经验。
- 精通Linux/Unix操作系统管理,具备丰富的系统崩溃、宕机现场处理经验。
- 熟练掌握Shell/Python脚本编程,能够独立完成自动化运维工具开发。
- 熟悉X86服务器硬件架构及主流存储(HDS、DELL、华为)的基本运维操作。
- 了解Oracle数据库基础知识,能与DBA协同工作。
- 具备良好的团队合作精神、强烈的责任心及抗压能力,能适应7×24小时On-Call工作模式。
- 具备优秀的文档撰写能力,能够清晰记录运维操作、故障处理流程及技术方案。