logo of aliyun

阿里云阿里云智能-虚拟化系统运维专家-杭州/上海

社招全职5年以上云智能集团地点:杭州 | 上海状态:招聘

任职要求


1.计算机或相关专业,5年以上虚拟化平台运维或开发经验,熟悉Linux内核机制。
2.精通KVM/QEMU架构,熟悉Libvirt、VFIO、vhost、SR-IOV等关键技术,具备实际调优经验。
3.熟练掌握Shell/Python等脚本语言,具备自…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1.负责虚拟化Hypervisor运维平台的架构设计、技术选型与核心功能开发。
2.主导虚拟化资源池的部署、优化与持续运维,保障高可用、高性能及可扩展性。
3.参与云平台与虚拟化层的深度集成,推动自动化部署、热迁移、热升级、变更等核心功能落地。
4.负责虚拟化相关问题的根因分析与性能调优,解决大规模实例运行中的稳定性与性能瓶颈。
5.设计并实施虚拟化相关质量保障体系,包括自动化测试框架、回归测试流程和故障注入演练。
6.协同管控、网络、存储、安全等团队完成虚拟化Hypervisor层的安全加固、合规改造与运维/质量标准化建设。
包括英文材料
Linux+
内核+
Bash+
Python+
还有更多 •••
相关职位

logo of aliyun
社招5年以上云智能集团

1. 在Intel/AMD/ARM等新硬件平台进行Hypervisor关键特性的研发,使能硬件加速能力,降低虚拟化性能开销。 2. 通过技术创新和软硬结合,构建Hypervisor在计算路径/IO路径上的数据校验能力,保障Hypervisor数据安全。 3. 提升虚拟机的运维能力,持续对热迁移/热升级/热插拔/快照技术进行打磨优化,保障线上系统稳定性。

更新于 2025-09-03杭州|上海
logo of aliyun
社招5年以上云智能集团

1. 负责GPU服务器依赖的虚拟化组件的开发迭代,来满足业务对稳定性、安全、性能、运维等方面的要求 2. 负责研究轻量虚拟化/安全容器等云原生场景下系统底层技术在GPU业务场景的应用 3. 负责GPU驱动在业务场景的功能开发、维护并和GPU厂商对接相关技术需求 4. 负责异构虚拟化领域前沿技术的探索,并推动有业务价值的技术落地

更新于 2025-08-18北京|杭州|上海
logo of aliyun
社招5年以上云智能集团

1. 依据公共云统一架构、OpenAPI规范、软件技术栈以及交付运维体系,负责专属云产品的研发与交付。深度参与灵骏裸金属服务器及EGS云计算服务器的研发流程,包括硬件架构预研、方案设计、软硬件结合的系统优化、线上服务质量保证以及提供专家技术支持等关键环节,确保产品从研发到运维的全生命周期高效管理。 2. 跟踪并把握GPU架构设计的发展趋势,探索前沿的GPU架构设计技术。联合高性能网络团队共同设计网络互联架构,针对分布式训练和推理业务场景,在软硬件协同及高性能网络方向上寻找性能优化的新途径,构建阿里云加速计算云服务器的核心竞争力。 3. 研发并持续改进系统的稳定性和安全性,确保平台的安全可靠运行,并不断提升对外服务质量标准。

更新于 2025-11-09杭州|上海
logo of aliyun
社招5年以上云智能集团

1. 依据公共云统一架构、OpenAPI规范、软件技术栈以及交付运维体系,负责公共云异构计算产品的研发与交付。深度参与研发流程,确保产品从研发到运维的全生命周期高效管理; 2. 跟踪和了解新的异构计算产品技术和趋势,探索前沿的GPU架构设计与技术,理解业务战略及重点,基于业务需求作出高可用、高可靠、高拓展性的技术架构规划和落地; 3. 联合网络团队共同设计网络互联架构,针对分布式训练和推理业务场景,在软硬件协同及高性能网络方向上寻找性能优化的新途径,构建阿里云加速计算云服务器的核心竞争力; 4. 研发并持续改进系统的稳定性和安全性,制定稳定性策略,寻找并解决产品系统中的潜在风险和瓶颈,覆盖线上疑难杂症问题,提高产品稳定性和性能确保平台的安全可靠运行,并不断提升对外服务质量标准。

更新于 2025-11-09杭州|上海