logo of aliyun

阿里云阿里云智能-AI Infra大模型推理软硬件结合优化-杭州

社招全职5年以上地点:杭州状态:招聘

工作描述


任职要求
1. 扎实的专业基础与经验:计算机、人工智能等相关专业,3年以上AI Infra、大模型推理系统、算子研发、性能优化、分布式优化等方向工作经验。
2. 丰富的大模型经验:精通C++/Python,熟悉并掌握主流推理框架(如vLLMSGLangTensorRT-LLM)、常用的端到端/系统/算子性能分析工具,有丰富的大模型实战经验 (LLM、多模态、DiT、世界模型等),具备独立完成从端到端到模块化的分析和调优的能力。
3. 扎实的优化经验:在大模型推理加速、算子开发、模型压缩/量化、分布式、PD分离等方面有实际项目经验,熟悉GPU/AI加速库(如cuBLAS、cuDNN、Cutlass)及并行通信技术(如NVLink、模型/流水线并行)。
4. 系统性技术认知:深入理解AI Infra大模型算法原理与推理部…
登录查看完整工作描述
微信扫码,1秒登录

包括英文材料
大模型+
C+++
Python+
vLLM+
SGLang+
TensorRT+
还有更多 •••
相关职位

logo of aliyun
社招5年以上

1. 扎实的专业基础与经验:计算机、人工智能等相关专业,3年以上AI Infra、大模型推理系统、算子研发、性能优化、分布式优化等方向工作经验。 2. 丰富的大模型经验:精通C++/Python,熟悉

更新于 2026-09-22杭州
logo of aliyun
社招5年以上

1. 扎实的专业基础与经验:计算机、人工智能等相关专业,3年以上AI Infra、大模型推理系统、算子研发、性能优化、分布式优化等方向工作经验。 2. 丰富的大模型经验:精通C++/Python,熟悉

更新于 2026-09-22杭州
logo of tencent
社招微信AI助手技术

1.熟练掌握 C/C++、Python语言,有计算机体系结构背景或软件开发背景,熟悉系统性能调优的方式; 2.具备基础的GPU编程能力,包括但不限于Cuda、OpenCL;熟悉至少一种GPU加速库,

更新于 2026-09-15北京
logo of tencent
社招1年以上搜一搜技术

1.岗位要求:; 2.熟悉AI基础硬件设置,有真实的大规模推理系统的设计开发部署经验; 3.熟悉各种主流LLM/VLM的模型结构,具有 vllm/sglang/TRT-llm等推理引擎优化实践经验

更新于 2026-06-11北京