荣耀AI模型端侧开发工程师
任职要求
1、学历背景:计算机、软件工程、电子信息、数学等相关专业本科及以上学历; 2、编程能力:精通 C/C++/Java,熟练掌握 Python,有良好的代码风格和工程习惯; 3、数理基础:扎实的线性代数、概率统计、数值…
工作职责
1、负责 AI 模型在端侧设备的移植、部署、优化,确保模型在资源受限环境下的高效运行; 2、参与端侧推理引擎的开发与维护,包括算子优化、模型量化/剪枝/蒸馏等压缩技术、模型运行时资源调度与管理的落地; 3、与模型/算法团队协作,将AI模型/算法(如 NLP、CV、语音、多模态模型)转换并适配至端侧平台(CPU/GPU/NPU/DSP 等); 4、负责模型性能/功耗调优,针对延迟、内存占用、功耗等指标进行持续优化。
1. 负责支持小鹏VLA2.0、智能座舱、具身等新一代大模型的部署架构设计和开发,不同芯片上架构统一。 2. 负责新一代大模型的端侧量产部署,解决各种端侧实际部署问题。 3. 负责在大模型自驾芯片上的性能优化,充分挖掘芯片性能,确保大模型的端侧软件性能表现满足量产需求。 4. 探索未来大模型和推理芯片上的新一代的软件架构和部署方案。
1.聚焦办公 PC、手机消费级终端大模型推理优化,负责端侧推理引擎性能调优,保障本地离线大模型平稳高效运行; 2.运用模型蒸馏、量化压缩、KV 缓存优化等轻量化技术,在保证效果前提下,降低端侧推理延迟、内存占用与硬件功耗; 3.负责端侧模型格式转换、算子适配与PC / 手机异构算力调度,充分调用 CPU、独显、端侧 NPU 算力,最大化设备推理性能; 4.对接 Intel、AMD 桌面端 AI 生态,适配本地推理服务框架,完成与上层业务框架快速集成落地; 5.梳理 PC 与手机端推理性能瓶颈,输出标准化优化方案,协同团队完成本地大模型方案规模化落地; 6.持续跟进桌面端、移动端轻量化推理前沿技术,优化本地离线推理体验。
我们正在寻找一位具有深厚技术背景和创新精神的端侧AI模型工程师加入我们的团队,专注于开发高效、轻量级的人工智能解决方案。主要负责设计与实现面向移动端或嵌入式设备的AI算法及模型优化工作,并通过SDK的形式提供给开发者使用。您将参与到从需求分析到产品上线的整个生命周期中,确保所开发的技术能够满足业务需求的同时保持良好的用户体验。 1. 参与端侧AI项目的规划与架构设计; 2. 根据应用场景需求,选择合适的深度学习框架进行模型训练; 3. 对已有模型进行量化压缩等操作以适应不同硬件平台; 4. 开发跨平台的SDK供内外部客户集成; 5. 与产品经理紧密合作,理解用户需求并转化为技术方案; 6. 持续跟踪业界最新动态和技术趋势,不断优化现有系统性能。