阿里云阿里云智能-稳定性SRE(AI & 云方向)-杭州/北京
社招全职5年以上云智能集团地点:北京 | 杭州状态:招聘
工作描述
任职要求
1. 5年以上云计算/2年以上AI相关工作经验,具备某一大产品领域知识(基础设施,数据域,云原生)+AI领域知识,经历过大型互联网系统的保障建设以及AI系统建设
2. 对云计算SRE有丰富的实战经验,如系统的高可用性架构实现、稳定性保障和提升,预案/演练/保障,协助业务开发团队实现系统的端到端可靠性。
3. 了解AI领域前沿技术进展,熟练掌握AI工具,对全栈AI(AI Infra,MA…登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
高可用+
https://redis.io/blog/high-availability-architecture/
A high available architecture is when there are a number of different components, modules, or services that work together to maintain optimal performance, irrespective of peak-time loads.
https://www.ibm.com/think/topics/high-availability
High availability (HA) is a term that refers to a system’s ability to be accessible and reliable close to 100% of the time.
相关职位

社招5年以上
1. 5年以上云计算/2年以上AI相关工作经验,具备某一大产品领域知识(基础设施,数据域,云原生)+AI领域知识,经历过大型互联网系统的保障建设以及AI系统建设 2. 对云计算SRE有丰富的实战经验,
更新于 2026-04-03北京|杭州
社招3年以上技术类-运维
1.计算机科学、软件工程或相关领域本科及以上学历,硕士优先。具备5年以上的云服务或站点稳定性工作经验,有AI Infra经验者优先; 2.熟悉AI基础设施架构、服务器硬件(如CPU/GPU芯片微架构)
更新于 2026-06-02北京|杭州
社招3年以上技术
1、3 年以上 SRE / 稳定性 / 运维开发经验,或资深研发工程师转稳定性方向,有大规模在线服务系统的稳定性保障与架构设计经验,对系统稳定性保障有全面深入的理解。 2、扎实的研发功底,至少精通一门
更新于 2026-09-06杭州|北京