logo of aliyun

阿里云阿里云智能-IDC基础设施运维专家-电气/暖通方向-张北

社招全职5年以上云智能集团地点:张家口状态:招聘

任职要求


•   5年及以上数据中心基础设施运维或设计经验, 3年及以上大型数据中心运维管理经验,领导自建园区、租用园区设施运维的经验
•   具备大型生产企业或数据中心安全及职业健康管理经验,支持过电气和暖通系统运营维护相关工作的安全管理者优先
•   精通基础设施领域各主要专业领域的全生命周期管理(暖通、电气等)
•   具备业务…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、日常运维
• 负责数据中心日常运维及管理工作,制定数据中心基础设施运维策略与运维计划,保障设施稳定性,均衡考虑运维质量、效率、成本及安全
• 通过设施数字化运维管理,提高机房管控能力和兜底能力,保障维修及时率、风险闭环率等各项指标达标。
2、安全合规
• 落实数据中心内所有岗位的安全生产要求,推动数据中心在环保、消防、职业健康、法务、廉正等方面的合规运营,防止出现人员/设备的重大责任事故、行政处罚/责令整改等被动监管事件。
• 识别安全合规风险,建立并完善风险管理机制,负责重大事件的上报和跟踪处理。
• 建立属地资源网络管理,推动与属地政府关系的全方位深化,为属地稳定安全合规运营提供坚实保障。
3、优化改进
• 负责所辖数据中心的设施运维工作优化,制定/梳理阿里IDC运维管理制度、操作手册、应急管理流程和应急操作预案。
• 负责阿里IDC能效优化工作,实现机房高效运行。
• 负责协同经营成本团队,通过建立成本分析模型、人效模型,实现对成本效率的精细化分析管控,达成经营目标。
4、技术支撑
• 负责数据中心运维侧技术管理,能带领团队通过技术管理为数据中心设计、设备选型等技术迭代提供技术支撑。
• 承担业务设备的现场技术支持,了解业务需求和网络结构,通过团队合作有效支撑数据中心运营。
5、团队管理
• 负责数据中心运维团队的日常管理、考核、人才梯队建设、能力培养,规划数据中心运维人员技术培训工作,提升运维团队服务水平。
• 建立与运营商、上级主管等部门间顺畅的沟通渠道,防止出现数据中心运营风险,确保阿里运营策略要求合规落地。
包括英文材料
相关职位

logo of aliyun
社招5年以上云智能集团

1、日常运维 • 负责数据中心日常运维及管理工作,制定数据中心基础设施运维策略与运维计划,保障设施稳定性,均衡考虑运维质量、效率、成本及安全 • 通过设施数字化运维管理,提高机房管控能力和兜底能力,保障维修及时率、风险闭环率等各项指标达标。 2、安全合规 • 落实数据中心内所有岗位的安全生产要求,推动数据中心在环保、消防、职业健康、法务、廉正等方面的合规运营,防止出现人员/设备的重大责任事故、行政处罚/责令整改等被动监管事件。 • 识别安全合规风险,建立并完善风险管理机制,负责重大事件的上报和跟踪处理。 • 建立属地资源网络管理,推动与属地政府关系的全方位深化,为属地稳定安全合规运营提供坚实保障。 3、优化改进 • 负责所辖数据中心的设施运维工作优化,制定/梳理阿里IDC运维管理制度、操作手册、应急管理流程和应急操作预案。 • 负责阿里IDC能效优化工作,实现机房高效运行。 • 负责协同经营成本团队,通过建立成本分析模型、人效模型,实现对成本效率的精细化分析管控,达成经营目标。 4、技术支撑 • 负责数据中心运维侧技术管理,能带领团队通过技术管理为数据中心设计、设备选型等技术迭代提供技术支撑。 • 承担业务设备的现场技术支持,了解业务需求和网络结构,通过团队合作有效支撑数据中心运营。 5、团队管理 • 负责数据中心运维团队的日常管理、考核、人才梯队建设、能力培养,规划数据中心运维人员技术培训工作,提升运维团队服务水平。 • 建立与运营商、上级主管等部门间顺畅的沟通渠道,防止出现数据中心运营风险,确保阿里运营策略要求合规落地。

更新于 2026-06-24张家口
logo of aliyun
社招5年以上云智能集团

1、日常运维 • 负责数据中心日常运维及管理工作,制定数据中心基础设施运维策略与运维计划,保障设施稳定性,均衡考虑运维质量、效率、成本及安全 • 通过设施数字化运维管理,提高机房管控能力和兜底能力,保障维修及时率、风险闭环率等各项指标达标。 2、安全合规 • 落实数据中心内所有岗位的安全生产要求,推动数据中心在环保、消防、职业健康、法务、廉正等方面的合规运营,防止出现人员/设备的重大责任事故、行政处罚/责令整改等被动监管事件。 • 识别安全合规风险,建立并完善风险管理机制,负责重大事件的上报和跟踪处理。 • 建立属地资源网络管理,推动与属地政府关系的全方位深化,为属地稳定安全合规运营提供坚实保障。 3、优化改进 • 负责所辖数据中心的设施运维工作优化,制定/梳理阿里IDC运维管理制度、操作手册、应急管理流程和应急操作预案。 • 负责阿里IDC能效优化工作,实现机房高效运行。 • 负责协同经营成本团队,通过建立成本分析模型、人效模型,实现对成本效率的精细化分析管控,达成经营目标。 4、技术支撑 • 负责数据中心运维侧技术管理,能带领团队通过技术管理为数据中心设计、设备选型等技术迭代提供技术支撑。 • 承担业务设备的现场技术支持,了解业务需求和网络结构,通过团队合作有效支撑数据中心运营。 5、团队管理 • 负责数据中心运维团队的日常管理、考核、人才梯队建设、能力培养,规划数据中心运维人员技术培训工作,提升运维团队服务水平。 • 建立与运营商、上级主管等部门间顺畅的沟通渠道,防止出现数据中心运营风险,确保阿里运营策略要求合规落地。

更新于 2025-11-12南通
logo of aliyun
社招5年以上云智能集团

1、负责阿里云海外数据中心运维技术中台的综合管理。 2、负责阿里云海外数据中心稳定性的整体管控,制定并持续优化运维标准流程、管理机制,开展日常运维过程质量分析,实现对数据中心稳定管理的技术、管理覆盖,确保达成稳定性目标。 3、开展数据中心的飞检评价,识别架构、维护、应急、人员、管理等风险,协助海外属地运维团队建立风险应急预案和整改方案,并协同推动风险整改闭环。 4、事件应急响应,通过全面掌握海外机房的架构、风险、运行逻辑等,对海外稳定性应急事件进行响应与技术支撑。

更新于 2025-10-16杭州
logo of horizon
社招3年以上软件序列

1. 基础设施与交付: 深度参与公司与云厂商/IDC 供应商的技术对接。负责物理架构方案的评审(包括高密机柜电力规划、散热评估、专线互联等),并跟进服务器及网络设备的上架、交付与验收。 2. 裸金属自动化: 负责租用物理机的底层初始化,完善基于 IPMI/Redfish 及 PXE/Cobbler 的裸金属自动化交付流程。 3. 供应商统筹与SLA管理: 制定并输出标准作业程序 (SOP/MOP),指挥并跟进云厂商驻场人员 (Remote Hands) 的现场操作(如硬件更换、线缆跳接);具备跨机房统筹能力,主导规划并执行类似洛杉矶等核心数据中心之间的服务器设备大规模物理迁移与网络割接。 4. AI 交付: 参与未来 GPU 算力集群的基础设施规划,主导或参与基于 Spine-Leaf 架构、400G 高速无损网络(如 RoCEv2 或 InfiniBand)的组网方案设计与落地验证。 5. 监控与应急响应: 通过 Zabbix、Grafana、Prometheus 等工具建立端到端的物理链路监控体系;快速响应底层网络或硬件故障,指导供应商完成排障。 6. 资产管理:建立硬件资产相关 CMDB 系统。

更新于 2026-06-29北京