IT服务器运维资深工程师(J13762)

  • 工作类型:全职
  • 职位类别:中文版
  • 职位学历:社招
  • 招聘人数:若干
  • 更新时间:2026.10.10
  • 工作地点:北京市,北京市-大兴区,北京市-亦庄开发区

职位描述

工作职责】
1. 负责Linux/Unix服务器及X86硬件平台的日常运行监控、例行巡检与健康检查,确保生产系统7×24小时稳定运行,核心设备可用性达到99.9%以上。
2. 快速响应并处理服务器硬件(CPU、内存、磁盘阵列、RAID卡、电源等)及存储(HDS、DELL、华为)的软硬件故障,主导故障排查、定位及修复,并输出详细的故障报告。
3. 负责操作系统层面的性能调优(内核参数、文件系统、I/O调度,等),识别并解决系统资源瓶颈,保障半导体业务应用的流畅运行。
4. 主导Linux/Unix平台的架构规划与设计,负责新服务器的OS安装、配置、基线加固及安全补丁管理。
5. 负责虚拟化平台(如VMware vSphere、KVM、OpenStack,等)的日常运维、资源池管理及容量规划,提升资源利用率。
6. 根据业务发展需求,评估并规划X86硬件及Unix系统的扩容、升级及技术改造方案,并推动实施落地。
7. 履行7×24小时On-Call职责,负责并参与重大故障的应急处理,并对一线值班人员进行技术指导。

职位要求

【专业技能】
1. 学历与经验: 计算机相关专业本科及以上学历,具有3年以上Linux/Unix系统及X86硬件维护管理经验。
2. 操作系统: 精通Linux(RHEL/CentOS/SUSE)及Unix(Solaris/ AIX)系统管理,包括安装部署、内核参数调优、文件系统管理、用户权限体系及系统安全加固。
3. 脚本能力: 熟练掌握Shell/Python脚本编程,具备自动化运维脚本(监控告警、日志分析、批量部署)的实际开发经验。
4. 硬件架构: 深入理解X86服务器硬件架构(如Dell PowerEdge、HPE ProLiant、华为 FusionServer),熟悉RAID技术、BMC/iDRAC带外管理及硬件故障排查方法论。
5. 存储管理: 了解主流存储系统(HDS VSP、DELL EMC、华为OceanStor)的基本原理、LUN映射、存储双活或复制技术,能配合存储工程师进行故障定位。
6. 虚拟化平台: 熟悉VMware vSphere或KVM虚拟化平台的搭建、虚拟机生命周期管理、资源调度及HA/DRS策略配置。
7. 数据库基础: 了解Oracle数据库的基本架构,能够配合DBA进行操作系统层面的资源分配、参数调整及性能问题初步定位。
8. 团队协作: 具备优秀的跨部门沟通能力、问题分析能力及文档撰写能力,能够输出高质量的故障报告及运维知识库文档。
【职位要求】
1. 计算机科学、信息技术或相关专业本科及以上学历。
2. 3年以上Linux/Unix系统运维经验,2年以上X86服务器硬件维护经验。
3. 精通Linux/Unix操作系统管理,具备丰富的系统崩溃、宕机现场处理经验。
4. 熟练掌握Shell/Python脚本编程,能够独立完成自动化运维工具开发。
5. 熟悉X86服务器硬件架构及主流存储(HDS、DELL、华为)的基本运维操作。
6. 了解Oracle数据库基础知识,能与DBA协同工作。
7. 具备良好的团队合作精神、强烈的责任心及抗压能力,能适应7×24小时On-Call工作模式。
8. 具备优秀的文档撰写能力,能够清晰记录运维操作、故障处理流程及技术方案。