logo of xpeng

小鹏汽车大模型部署与优化实习生 (Embodied AI)

实习兼职地点:深圳状态:招聘

任职要求


【职位要求】
国内外知名高校硕士及以上学历在读,计算机科学、人工智能、机器人等相关专业优先。
熟悉 CUDA 编程、多线程,有 TensorRT-LLM等推理框架经验,或有机器人部署加速相关开发项目经验者优先。
熟练掌握 C++Python,有C++开发项目经验,具备扎实的编程能力和算法理论基础。
熟悉深度学习基本原理,对 LLM
登录查看完整任职要求
微信扫码,1秒登录

工作职责


【关于我们】
小鹏机器人中心致力于研发先进的人形机器人技术,包括机器人的行走、操作、智能导航,以及在大语言模型支持下的人机交互等。我们的软硬件团队覆盖深圳、上海、广州、北京和北美,组成了一支世界一流的跨领域团队。作为本团队的一员,你将成为连接人工智能与物理世界的桥梁,与其它领域的工程师共同解决前沿的科研和工程难题,并在机器人技术的发展中留下自己的印记。


作为小鹏机器人核心团队的实习生,你将深入参与具身智能(Embodied AI)VLA 大模型的全链路优化工作,主要探索和负责以下领域:
核心职责:参与具身 VLA 大模型的部署优化,熟悉算子优化、模型量化等原理。
技术探索:参与研究和应用最新的大模型结构,探索软硬一体的高效模型部署设计方案,提升模型推理性能。
团队协作:与算法、硬件及基础设施团队紧密合作,共同推进模型从训练到部署的迭代,解决前沿工程技术与算法论文在真实场景中的落地挑战。
包括英文材料
学历+
CUDA+
多线程+
TensorRT+
大模型+
C+++
Python+
还有更多 •••
相关职位

logo of keep
社招2年以上

1、负责运动健康垂类大模型的推理服务建设与性能优化,涵盖 SLM / LLM / VLM 等多种模型形态; 2、基于 vLLM / SGLang 等推理框架,持续优化首 token 延迟、吞吐量及 GPU 资源利用率; 3、设计并实现模型推理加速方案,包括 Prefix Caching、Speculative Decoding、量化部署等; 4、负责多模型统一接入与请求调度网关的开发,根据不同业务场景实现智能路由与负载均衡; 5、负责与推理引擎相关的 Context / KV Cache 管理优化(如长上下文、Prefix 复用等),支撑上层 Agent 场景的高效落地; 6、构建模型服务的可观测性体系,包括延迟监控、请求全链路 trace、成本归因与降级熔断策略; 7、与算法研究员紧密协作,完成模型从训练产出到线上服务的全链路打通; 8、跟进大模型推理优化领域的前沿技术进展,持续迭代推理架构和服务性能。

更新于 2026-05-09北京
logo of horizon
实习算法序列

1、参与VLA模型在仿真环境中的部署与运行,支持数据采集、任务执行与结果统计; 2、参与LLM/VLM/VLA模型的工程化训练与推理流程搭建,支持模型在不同配置下的运行与评测; 3、参与模型压缩、量化、推理加速等工程优化工作,对不同方案进行实验验证与性能对比; 4、配合完成模型部署相关的脚本、工具与文档,提升整体工程稳定性与可复现性。

更新于 2026-03-09北京
logo of horizon
社招算法序列

1. 搭建高效的AI系统,为算法迭代和部署提供模型优化、量化、部署的高效算法工具链; 2. 使用模型优化技术,包括模型低精度量化、模型压缩/裁剪,熟悉大模型的量化、长上下文推理优化等,开发模型优化的工具链,对模型进行优化加速; 3. 参与软硬件协同优化设计。与硬件工程师协作,参与硬件设计和优化,提供模型在私有硬件平台的执行效率。

更新于 2025-11-17北京|上海
logo of xpeng
实习

负责将大语言模型、多模态模型和具身智能模型高效部署到机器人端侧芯片和云端,实现低延迟实时推理。 1、负责 VLT(任务规划模型)、Omni(多模态交互模型)、VLA(操作模型)等大模型在 XP5 芯片上的端侧部署,完成模型量化(INT8/INT4/FP8)、图优化和推理加速; 2、设计和优化云端模型推理服务(基于 vLLM/TensorRT-LLM),支撑 VLT 云端推理的高并发低延迟需求; 3、开发运动控制模型(ONNX)在实时系统中的高性能推理管道,满足 500Hz 控制频率要求; 4、建立模型部署的标准化流程:模型转换→量化→性能基准测试→端侧验证→上线发布; 5、与算法团队协作,从模型设计阶段介入,提供部署可行性评估和性能预估。

更新于 2026-04-10深圳|北京|上海