logo of bytedance

字节跳动DC服务器运维工程师

社招全职O8293地点:深圳状态:招聘

任职要求


1、有丰富的互联网大规模服务器运营运维经验,熟悉互联网运营运维流程体系,熟悉服务器全生命周期运营管理;具备服务拓展创新理念和运营服务拓展经验;
2、熟悉服务器硬件产品开发和交付流程,有0-1打造服务器硬件产品的经验;熟悉产品开发生命周期管理,包含产品线规划、产品阶段管理、产品文档管理;熟悉服务器运维场景,熟练掌握服务器可维护性、易维护性、稳定性风险识别能力,具备服务器新产品引入运营适配经验和能力;
3、熟悉服务器硬件架构及工作原理,精通主流服务器硬件架构(x86、ARM等)及其配套软件,具备大规模服务器运维管理,如固件升级管理、带外服务管理等经验,能够独立制定和落实服务器运维管理方案;
4、熟悉服务器故障模型、日志体系,熟悉服务器故障监控、日志分析、故障诊断;擅长问题分析和解决,能够独立完成服务器异常排查和优化,能独立处理复杂的系统级硬件故障,制定应急预案和长期解决方案;
5、熟悉服务器行业维保和技术服务交付流程和体系构成,具备成本意识,擅长结合海量运营,转化维保运营运维能力为成本优化项;
6、熟悉海量服务…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责字节跳动中国区线上海量服务器全生命周期运营运维管理和技术服务,面向业务提供和交付业界第一的服务器运营运维服务,促进和保障业务稳定发展;工作职责涵盖新产品运维引入、运维监管控等运营适配、线上运营管理、稳定性运营管理、数据中心服务器运维管理、维保维修、运营流程规范和平台系统规划建设等方向;
2、负责服务器新产品引入运营管理和适配体系化建设,包含制定服务器运维标准基线,规划设计、迭代优化新品可维护性、易维护性、稳定性方案,负责新品引入运营风险识别和评估评审、新产品运营运维方案建设适配等;
3、负责线上服务器基础运营服务,规划和建设稳定安全高效的基础运营服务架构和服务能力,包含固件升级、带外管理、开关机、重启、重装、搬迁等服务架构和能力;
4、负责线上服务器整体维保和技术支持服务交付,规划和建设稳定高效的维保和技术支持体系架构和运维能力,建设改配和利旧交付能力,打造稳定可靠低成本的维保和技术支持服务,保障业务连续性和持续发展;
5、负责线上服务器稳定性保障服务,规划和建设稳定性流程规范、平台系统、保障机制和能力,负责现网运营稳定性监控、稳定性风险识别、问题响应处理和保障措施,保障业务稳定健康运行;
6、负责数据中心IT运维服务,数据中心现场IT运营运维管理、园区物理管理和属地公共关系处理等工作,规划和建设标准化运维体系和能力,监控和防范数据中心IT运维风险,全方位保障数据中心稳定健康运行;
7、负责边缘机房物理资源软硬交付、线上网络服务器一体化运维服务,规划和建设边缘运营服务标准和能力,开展供应商及数据中心IT风险管理,协同商务以更优的服务和成本优势支持业务发展;
8、负责运营运维流程规划设计、管理和优化,平台系统方案规划和设计,通过系统化和自动化方案提升运营效率和质量。
包括英文材料
Linux+
Bash+
脚本+
还有更多 •••
相关职位

logo of ly
社招3年以上

职位描述: 负责集团内DC/AD域、ADFS、Exchange邮箱等核心办公系统产品的整体规划,实施和运维,致力于提升系统稳定性和高效运转; 负责集团内DFS文件系统、DHCP、DNS等基于Windows平台架构的产品运维; 负责集团内VPN系统日常运维和稳定性保障; 负责集团数据设备等容灾与备份,定期进行应急演练,备份数据测试,保障系统和数据安全; 提供高效的办公IT解决方案,提升用户工作效率。

更新于 2022-10-27苏州
logo of aliyun
社招5年以上云智能集团

1、负责产品的硬件设计交付,实现产品化,对产品端到端交付质量运维负责,辅助并督导上游ODM/OEM开展设计和质量运维保障工作; 2、对标业界标杆,引入先进质量运维管理方法,并制定相关产品的全流程质量运维管控方案并主导实施,开展供应商质量审核、质量体系评估、运维能力管理,确保改善措施的有效实施; 3、主导分析解决和预防重大产品质量运维问题,主导产品质量问题分析、定位及质量问题的处理与预防; 4、负责大规模服务器从交付到退役的全生命周期运维工作,包括新机型导入(NPI)、操作系统安装、维修、硬件监控、硬件重构、服务器管理等运维自动化系统架构、设计、研发,确保交付质量与效率满足SLA要求; 5、参与制定服务器可靠性标准及平台建设,负责风险应急处置,保障系统稳定性,提升业务的安全性与可持续性; 6、持续跟踪硬件相关领域的技术发展趋势,结合对阿里业务应用场景的深入分析,并推动相关技术的产品化实现。

更新于 2025-11-14深圳|杭州
logo of aliyun
社招5年以上云智能集团

1.负责产品的硬件设计交付,实现产品化,对产品端到端交付质量运维负责,辅助并督导上游ODM/OEM开展设计和质量运维保障工作; 2.对标业界标杆,引入先进质量运维管理方法,并制定相关产品的全流程质量运维管控方案并主导实施,开展供应商质量审核、质量体系评估、运维能力管理,确保改善措施的有效实施; 3.主导分析解决和预防重大产品质量运维问题,主导产品质量问题分析、定位及质量问题的处理与预防; 4.持续跟踪硬件相关领域的技术发展趋势,结合对阿里业务应用场景的深入分析,并推动相关技术的产品化实现。

更新于 2025-08-28深圳|杭州
logo of aliyun
社招5年以上技术类-开发

1、负责产品的硬件设计交付,实现产品化,对产品端到端交付质量运维负责,辅助并督导上游ODM/OEM开展设计和质量运维保障工作; 2、对标业界标杆,引入先进质量运维管理方法,并制定相关产品的全流程质量运维管控方案并主导实施,开展供应商质量审核、质量体系评估、运维能力管理,确保改善措施的有效实施; 3、主导分析解决和预防重大产品质量运维问题,主导产品质量问题分析、定位及质量问题的处理与预防; 4、持续跟踪硬件相关领域的技术发展趋势,结合对阿里业务应用场景的深入分析,并推动相关技术的产品化实。

更新于 2025-06-07深圳|杭州