logo of xpeng

小鹏汽车具身智能模型推理架构师

社招全职智能机器人板块地点:深圳状态:招聘

任职要求


1、计算机、人工智能、自动化等相关专业本科及以上学历;
2、具备端侧模型部署、推理框架、大模型推理服务、AI 芯片工具链或模型压缩优化中的一类或多类工程经验;
3、精通 C++,熟练使用 Python,具备扎实的 Linux 系统编程、并发编程和性能分析能力;
4、深入理解模型推理全流程,包括模型转换、运行时执行、内存管理、并发调度、性能评测及问题诊断;
5、在以下至少一个方向具备深入经验:
推理 Runtime、内存管理或并发执行优化;
PTQ、QAT、混合精度等模型量化与精度对齐;
嵌入式 NPU 模型适配、部署与性能优化;
异构资源调度、内存优化或多模型协同运行;
6、理解 Transformer、VLM、VLA 等模型的计算与访存特性,能够结合硬件特点分析性能瓶颈;
7、有复杂模型从算法原型到产品部署的完整实践,能够协同…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、主导具身智能模型推理系统的架构设计、核心开发与落地,制定模型运行、适配、优化和部署的整体技术方案;
2、建设统一的模型推理 Runtime 与服务框架,完善模型加载、执行、并发、生命周期管理及标准化接口,支撑不同模型快速接入;
3、建立模型压缩、量化与精度对齐能力,在性能、精度、内存与功耗之间进行系统优化,保障模型在小鹏自研芯片平台上的精度一致性与稳定运行;
4、设计端侧异构算力与多模型调度机制,优化 CPU、GPU、NPU 等计算资源的分配和协同,提升复杂任务下的资源利用率与推理效率;
5、从模型设计阶段介入部署可行性与性能评估,建设覆盖模型转换、量化、性能基准、端侧验证和发布的标准化工具链,协同算法、芯片及业务团队推动模型稳定量产。
包括英文材料
学历+
大模型+
C+++
Python+
Linux+
Transformer+
算法+
还有更多 •••
相关职位

logo of horizon
实习算法序列

1、参与VLA模型在仿真环境中的部署与运行,支持数据采集、任务执行与结果统计; 2、参与LLM/VLM/VLA模型的工程化训练与推理流程搭建,支持模型在不同配置下的运行与评测; 3、参与模型压缩、量化、推理加速等工程优化工作,对不同方案进行实验验证与性能对比; 4、配合完成模型部署相关的脚本、工具与文档,提升整体工程稳定性与可复现性。

更新于 2026-03-09北京
logo of alibaba
社招2年以上

定位: 负责具身AI数据评测体系建设、标注质量管理与数据交付,通过数据集健康度评估、模型效果评测与Badcase分析,驱动数据质量与模型性能的闭环迭代。 职责: 1.设计数据评测方案,定义评测维度与指标(完整性、一致性、多样性分布、标注准确率等),组织评测并输出分析报告 2.管理数据标注与交付流程:制定标注规范、质检抽样,对接供应商完成试标验收与质量跟踪;按算法需求完成数据格式对齐与打包交付 3.构建数据集健康度评估体系:覆盖帧丢失率、传感器同步误差、场景/轨迹分布偏差与长尾缺失 4.开展模型效果评估与Badcase分析,推动改进闭环 5.编写自动化脚本辅助数据清洗、质检与交付流程,定期输出数据质量报告

更新于 2026-07-07杭州
logo of xpeng
校招

负责具身智能模型在机器人端和小鹏自研芯片平台上的适配、优化与部署,参与模型转换、量化、性能评测、精度验证和上线发布全流程。 通过工程优化提升模型推理性能、资源利用率和运行稳定性,推动算法能力高效落地到机器人产品。 岗位职责 负责 VLM、VLA、多模态及其他具身智能模型在小鹏自研芯片平台上的转换、适配、量化与部署; 开展端侧推理性能评测与优化,分析时延、内存、功耗和算力利用率等关键指标; 建立模型精度对齐与自动化回归能力,定位模型转换、量化及算子适配过程中的精度问题; 参与模型部署工具链建设,完善模型转换、性能基准、端侧验证和发布流程; 与算法和芯片团队协作,从模型设计阶段参与部署可行性评估,推动模型在机器人端稳定运行。

更新于 2026-07-24深圳
logo of aligenie
社招5年以上技术类-算法

工程岗位的职责包括以下至少一个或多个方向: 1. 具身机器人应用解决方案研发 (1)参与多模态/具身智能机器人在真实场景中的应用方案设计、系统集成与验证。 (2)搭建端到端具身机器人任务pipeline,包括感知、理解、规划、控制、执行等模块的工程化实现。 (3)推动具身智能大模型能力在机器人实际任务中的落地优化(如操作、导航、交互等)。 2. 具身大模型数据采集与处理 (1)负责机器人数据采集系统搭建,包括传感器标定、采集流程、数据质量控制与自动化工具链。 (2)建设具身大模型训练数据pipeline:数据清洗、切分、标注、同步、增强、格式转换等工程化流程。 (3)参与构建多模态数据集(视频、RGB-D、触觉、关节状态、语言指令等)。 3. 具身大模型云端训练与推理优化 (1)基于GPU/加速器的训练平台优化具身大模型训练性能(并行策略、数据流优化、算子优化)。 (2)负责推理引擎优化,包括模型裁剪、编译器优化、图优化、缓存管理、多线程并发调度等。 (3) 参与构建具身智能模型的训练与推理服务基础设施(MLOps、分布式训练、数据版本管理等)。 4. 端侧模型量化部署与优化 (1)主导端侧模型的压缩、量化(INT8/FP8/混合精度等)、剪枝、蒸馏等部署优化工作。 (2)熟悉ONNXRuntime、TensorRT、TFLite、NPU/DSP编译工具链,进行端侧加加速与算子调优。 (3)推动具身大模型在机器人嵌入式/边缘计算平台上的高效部署。 5. 机器人操作系统与系统优化 (1)优化机器人操作系统(ROS2、RTOS、Linux)性能,包括实时性、通信延迟、资源调度、驱动层稳定性等。 (2)推动机器人软硬件协同优化,包括传感器驱动、控制链路优化、系统级profiling/debugging。 (3)支撑机器人任务的稳定运行与系统级可靠性优化。

更新于 2026-04-02北京|杭州