美团【北斗】自动驾驶决策规划算法工程师
校招全职软硬件服务-无人车业务部地点:北京 | 深圳状态:招聘
工作描述
任职要求 【岗位要求】 1.自动化、计算机科学、人工智能等相关专业硕士及以上学历; 2.具备扎实的强化学习理论基础,熟悉PPO、SAC、TD3、DDPG等主流强化学习算法,有相关项目实践经验。熟悉世界模型 / 生成模型(JEPA、Dreamer、RSSM 等)等相关经验者优先。 3.在国际顶级计算机会议/期刊(如NeurIPS、ICML、ICLR、ACL、TPAMI等)以一作身份发表过多篇论文,或在开源社区、竞赛中展示出引领性的研究成果; 4.具备自动驾驶与机器人等复杂决策场景落地经验者优先。 【为…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
算法+
https://roadmap.sh/datastructures-and-algorithms
Step by step guide to learn Data Structures and Algorithms in 2025
https://www.hellointerview.com/learn/code
A visual guide to the most important patterns and approaches for the coding interview.
https://www.w3schools.com/dsa/
NeurIPS+
https://neurips.cc/
还有更多 •••
相关职位
校招软硬件服务-无人
【任职资格】 1.计算机科学、人工智能领域,具有扎实的深度学习、计算机视觉/自然语言处理基础; 2.具有优秀的编程能力,熟悉PyTorch、Tensorflow等深度学习框架,能熟练进行模型研发和
更新于 2026-06-11北京|深圳
校招软硬件服务-无人
【岗位要求】 1.计算机、人工智能、自动化、电子工程等相关专业本科及以上学历,具备扎实的计算机系统、机器学习与工程基础; 2.在 AI Infra、分布式训练、自动驾驶、基础模型(Foundation
更新于 2026-06-11北京
实习核心本地商业-基
1、硕士及以上学历,计算机或相关专业,博士优先; 2、在 ML / NLP / RL / CV / Speech 等相关方向有扎实的研究基础,在 ACL / EMNLP / NAACL / NeurI
更新于 2026-04-03北京|上海