logo of aliyun

阿里云阿里云智能-容器服务与 Agent 基础设施高级技术专家-北京/杭州/深圳

社招全职7年以上云智能集团地点:北京 | 深圳 | 杭州状态:招聘

任职要求


1.计算机、软件工程及相关专业,计算机基础知识与编程基本功扎实,熟悉Go/Python/C++至少一种。
2.熟悉至少一项云原生技术(如Docker/Containerd/KataContainer/gVisor, Kubernetes等),有相关开源项目贡献或者大规模开发运维经验者优先。
3.熟悉分布式计算/存储/调度系统的开发运维,具有基本的性能和稳定性优化经验。
4.有构建和运维MLOps/AI工程平台,运行模型训练/推理…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1.负责阿里云容器平台在AI基础设施与应用架构方向的产品研发与技术演进。
2.主导大规模异构资源(GPU/NPU/RDMA等)集群的调度、管理与性能优化,提升资源利用效率、系统稳定性与运行性能。
3.构建面向AI与Agent应用的Serverless容器算力产品,
4.基于Kubernetes打造面向大模型训练/推理、大规模数据处理及Agent应用的云原生基础设施产品与解决方案。
5.推动云原生AI领域前沿技术预研、落地及开源生态建设,持续引领技术创新与行业实践。
包括英文材料
Go+
Python+
C+++
还有更多 •••
相关职位

logo of aliyun
社招5年以上云智能集团

1. CI/CD平台建设:负责构建高效、易用的持续集成平台,支撑团队月均十万次的构建、集成及测试任务执行; 2. 质量体系构建:通过技术创新和工程能力建设,全面提升产品质量,涵盖研发流程优化、测试策略制定、缺陷深度分析及智能诊断等核心环节; 3. 测试效能提升:设计并开发通用测试框架与脚手架工具,推动测试基础设施和测试代码架构升级,提升测试用例的易用性和一致性,显著改善产品测试效率和迭代速度; 4. 混沌工程实践:基于故障复盘与演练机制,持续推进产品容灾能力提升,不断完善混沌工程体系建设,全面覆盖核心容灾场景。

更新于 2025-11-05杭州
logo of aliyun
社招5年以上云智能集团

1. 负责阿里云容器云原生AI和大数据产品的架构设计和开发工作 2. 负责容器产品调度、管理大规模GPU/NPU/RDMA等异构资源集群的效率、性能和稳定性的持续优化 3. 负责基于Kubernetes容器构建面向AI/大模型训练和推理,大规模数据处理和工作流等场景的基础设施产品和解决方案 4. 负责云原生AI领域新技术和新方向的预研和落地,及相关开源能力建设

更新于 2025-11-26北京|杭州
logo of aliyun
社招5年以上云智能集团

1.负责阿里云容器平台在AI基础设施与应用架构方向的产品研发与技术演进; 2.主导大规模异构资源(GPU/NPU/RDMA等)集群的调度、管理与性能优化,提升资源利用效率、系统稳定性与运行性能; 3.设计并开发面向AI Agent场景的Serverless容器算力产品; 4.推动云原生AI领域前沿技术预研、落地及开源生态建设,持续引领技术创新与行业实践。

更新于 2026-01-05北京|杭州
logo of aliyun
社招5年以上云智能集团

- 负责阿里云容器平台在AI基础设施与应用架构方向的产品研发与技术演进 - 主导大规模异构资源(GPU/NPU/RDMA等)集群的调度、管理与性能优化,提升资源利用效率、系统稳定性与运行性能 - 构建面向AI与Agent应用的Serverless容器算力产品 - 基于Kubernetes打造面向大模型训练/推理、大规模数据处理及Agent应用的云原生基础设施产品与解决方案 - 推动云原生AI领域前沿技术预研、落地及开源生态建设,持续引领技术创新与行业实践

更新于 2026-01-05北京|杭州