美团【基座大模型北斗实习】智能体系统的通用游戏能力与开放世界探索能力研究
实习兼职核心本地商业-基础研发平台地点:北京 | 上海状态:招聘
工作描述
任职要求 岗位要求: 1、本科及以上学历,计算机、人工智能、自动化、数学、物理等相关专业在读; 2、在强化学习、文本/多模态大模型训练、Agent 、世界模型等一个或多个领域有较深入的研究和实践经验者; 3、好奇心驱动,具有出色的分析、解决问题的能力,有自主探索解决方案的能力者; 4、具有良好的沟通协作能力,对追求纯粹的技术有强烈热情,工作积极主动,能够与团队融洽合作,一起探索新技术并快速试验想法,推进技术进步。 工作职责 简介:我们认…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
还有更多 •••
相关职位
实习核心本地商业-基
1、本科及以上学历,计算机、人工智能、自动化、数学、物理等相关专业在读; 2、在强化学习、文本 / 多模态大模型训练、Agent、世界模型等一个或多个领域有较深入的研究和实践经验者; 3、好奇心驱
更新于 2026-04-07北京|上海
实习核心本地商业-基
1、硕士及以上学历,计算机或相关专业,博士优先; 2、在 ML / NLP / RL / CV / Speech 等相关方向有扎实的研究基础,在 ACL / EMNLP / NAACL / NeurI
更新于 2026-04-03北京|上海
实习核心本地商业-基
1、硕士及以上学历,计算机、人工智能、数学、自然语言处理等相关专业,博士优先; 2、在大模型领域有研究基础,或参与过有影响力的开源项目,在ICLR/NeurIPS/ICML/ACL等顶会发表论文者优先
更新于 2026-04-03北京|上海