美团【基座大模型北斗实习】下一代智能体系统与智能体自进化/持续学习能力研究
实习兼职核心本地商业-基础研发平台地点:北京 | 上海状态:招聘
工作描述
任职要求 1、本科及以上学历,计算机、人工智能、自动化、数学、物理等相关专业在读; 2、在强化学习、文本 / 多模态大模型训练、Agent、世界模型等一个或多个领域有较深入的研究和实践经验者; 3、好奇心驱动,具有出色的分析、解决问题的能力,有自主探索解决方案的能力者; 4、具有良好的沟通协作能力,对追求纯粹的技术有强烈热情,工作积极主动,能够与团队融洽合作,一起探索新技术并快速试验想法,推进技术进步。 工作职责 简介:下一代智能体系统的构建作为 2026 年进一步实现 AGI 的发展重点,claw 的火爆也揭示了这里的丰富潜力。我们认为,训练智能体系统的核心在于训练对任意复杂的环境进行合理交互、并在复合guidance 信号下充分进行系统级长程任务解决的能力。对于启发下一代智能体系统构建的任务,我们主要拆解如下特点: 1、长程性 :模型需要具备可靠地进行长周期任务执行的…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
还有更多 •••
相关职位
实习核心本地商业-基
1、有好奇心,敢想敢做,学习能力强,能在复杂问题的深度思考与拆解能力; 2、顶会论文(ACL/EMNLP/NeurIPS/ICLR/KDD 等)、开源贡献或算法竞赛成果突出者优先; 3、有OpenCl
更新于 2026-04-03北京|上海
实习核心本地商业-基
1、熟悉NLP、LLM、MLsys、Optimization、OR、Control、RL等相关领域,对其中一个或多个方向有深入的研究经历,且有相关实际项目经验; 2、熟悉Python、C++等至少一门
更新于 2026-04-03北京|上海
实习核心本地商业-基
1、熟悉NLP、LLM、MLsys、Optimization、OR、Control、RL等相关领域,对其中一个或多个方向有深入的研究经历,且有相关实际项目经验; 2、熟悉Python等至少一门编程语言
更新于 2026-04-03北京|上海