logo of hello

哈啰智驾决策规划算法工程师/专家(RL方向)-【自动驾驶】

社招全职算法地点:北京 | 上海状态:招聘

任职要求


1. 计算机科学、自动化、机器学习、机器人学等相关专业本科及以上学历;
2. 具备扎实的强化学习理论基础,熟悉主流RL算法(PPO、SAC、TD3、IQL等),并至少在一项自动驾驶或机器人项目中具有RL算法落地经验;
3. 熟练掌握Python/C++,熟悉PyTorch等深度学习框架,具备大规模强化学习分布式训练(如Ray、Kubernetes)或仿真平台开发经验者优先;
4. 熟悉自动驾驶决策规划常见方法(如MDP/POMDP、搜索与优化算法),并能够将强化学习与传统规划方法(如MPC、Lattice)结合解决实际问题;
5. 具备良好的数学基础…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1. 负责基于强化学习(如Online/Offline RL、Model-based RL)的自动驾驶行为决策与运动规划算法研发,重点解决结构化道路(高速、城市快速路)及非结构化场景(自动泊车)中的动态交互与博弈问题;
2. 针对复杂动态场景(密集车流、无保护路口、人车混流),设计基于数据驱动的决策规划算法,通过大规模分布式训练系统提升策略的智能性、安全性及泛化能力;
3. 构建与迭代仿真环境(如CARLA、NVIDIA Isaac)与世界模型,推动强化学习策略的仿真训练与实车迁移(Sim2real),形成“真实数据→仿真训练→实车验证”的闭环优化;
4. 参与全栈自动驾驶决策控制系统的开发,对接感知、预测、端到端模块,实现基于强化学习的决策规划算法在车载平台上的部署、性能优化与实车路测;
5. 跟踪强化学习在自动驾驶领域的前沿进展(如大模型与RL结合、逆强化学习、多智能体博弈),进行技术预研与算法创新,推动研究成果在量产项目中的应用与落地。
包括英文材料
机器学习+
学历+
强化学习+
算法+
自动驾驶+
Python+
C+++
PyTorch+
还有更多 •••
相关职位

logo of hello
社招2年以上综合

1. 负责端到端模型数据需求管理、交付排期与全流程质量管控; 2. 推动构建数据挖掘规范、数据质检机制,保障数据精度与交付效率,推动数据生产流程持续优化; 3. 组织团队周会/评审,跟踪项目开发进度、问题闭环和风险管理; 4. 跨团队协同算法、工程、标注和数据闭环等团队,保障数据与训练的项目落地。

更新于 2026-06-24北京|上海
logo of didi
社招技术

1、主导Feedforward-3DGS核心算法研发,推动实时渲染与动态场景重建技术落地,支撑端到端模型训练与闭环仿真; 2、探索端到端大模型中的3DGS监督,以自监督方式对BEV、OCC等特征进行优化,提升模型泛化性; 3、设计高效训练管线,实现算法从原型到产品的全链路部署,优化大模型在显卡硬件训练与推理效率;

更新于 2026-06-05北京
logo of horizon
社招3-5年市场品牌序列

1.深度拆解智驾软硬件产品核心卖点,将专业技术语言转化为大众易懂、有感染力的传播内容,搭建完整产品传播故事线 2.负责智驾产品传播策划,涵盖新品发布、技术迭代、场景化体验等核心场景,落地高转化传播项目。 3.独立完成高质量内容产出,包括产品通稿、技术解读、白皮书、案例故事、短视频脚本等,把控内容精准度与传播调性,支撑品牌声量提升与产品口碑沉淀。 4.协同产品、研发、营销团队,同步产品迭代动态与技术亮点,输出针对性传播策略;监测行业舆情与竞品传播动态,快速响应热点并优化传播方案。

更新于 2026-06-24北京
logo of horizon
社招3年以上硬件序列

1.对接底盘供应商,制定驱制动、转向等执行器的验收标准,完成HIL测试及实车验收 2.开发MCU应用层线控核心模块:车辆控制、功能安全、数据同步、休眠唤醒 3.线控软件开发与调校:纵向加速度闭环、横向转向角控制闭环等 4.智驾控制参数调校,纵向泊车、行车参数调校 5.跟踪线控执行器技术动态

更新于 2026-01-22北京|上海