logo of aliyun

阿里云阿里云智能-AI系统性能优化技术专家-AI领域-北京/杭州/上海

社招全职5年以上云智能集团地点:北京 | 杭州 | 上海状态:招聘

任职要求


1. 熟悉深度学习框架(pytorch),分布式训练和推理技术框架(如deepseed、fsdp、megatron、vllm、sglang);
2. 熟悉AI系统的性能分析工具(如Nsight、PyTorch Profiler等);
3. 具备性能建模与仿…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1. 负责灵骏集群的AI系统性能分析与优化,支持客户多个AI作业场景在不同平台芯片和多种集群规模下的适配和性能调优,能快速且以工具/产品化方式识别性能瓶颈并提出解决方案;
2. 针对主流深度学习框架、分布式训练和模型部署场景等,进行性能调优,优化算子性能、通信性能、内存利用率等关键指标,提升集群整体运行效率;
3. 对AI系统进行性能建模与仿真,建立Roofline模型等性能分析工具。通过仿真结果辅助系统设计和资源分配,为集群建设提供数据支持;同时推荐最佳训练和模型部署配置,辅助用户拿到最佳性能实践;
4. 负责开发和维护性能分析工具,支持系统性能监控、瓶颈定位和优化效果评估,提供性能分析报告,为团队和客户提供性能优化建议。
包括英文材料
深度学习+
PyTorch+
Megatron+
还有更多 •••
相关职位

logo of amap
社招3年以上技术类-开发

● 负责搜推业务全链路性能优化,从特征获取到模型推理的端到端延迟优化 ● 设计和优化特征处理pipeline,包括特征并行计算、批处理、缓存策略等 ● 分析和优化系统瓶颈,包括网络IO、存储访问、CPU/GPU利用率等关键

更新于 2025-12-10北京
logo of aligenie
社招3年以上技术类-开发

● 负责搜推业务全链路性能优化,从特征获取到模型推理的端到端延迟优化 ● 设计和优化特征处理pipeline,包括特征并行计算、批处理、缓存策略等 ● 分析和优化系统瓶颈,包括网络IO、存储访问、CPU/GPU利用率等关键

更新于 2026-03-31北京
logo of oppo
校招软件类

1. 负责端侧AI子系统架构优化与开发; 2. 负责端侧记忆系统的设计与开发; 3. 负责端侧数据平台的创新与优化;

更新于 2026-07-15成都|深圳
logo of mi
实习

1. 模型优化与部署落地 - 独立使用YOLO系列完成目标检测任务,进行精度/速度调优 - 基于TensorRT/OpenVINO优化模型推理性能,并独立完成在现有系统中的部署接入 2. 大模型分析与报告生成 - 调用主流大模型API(如GPT、Qwen等),独立设计并实现数据自动分析与周期报告生成功能 - 对模型效果进行对比分析,自主选择最优模型方案并落地到业务中 3. 系统功能迭代与体验优化 - 具备基础前后端开发能力,能基于现有代码独立进行功能修改、样式调整与交互优化 - 独立完成模型到系统功能的闭环,包括接口封装、性能调优、异常处理,确保系统稳定运行与用户体验流畅

更新于 2025-09-24上海