小米机器人操作世界模型算法实习生
实习兼职地点:北京状态:招聘
任职要求
1. 机器人、人工智能、计算机、自动化等相关专业,硕士或博士在读优先; 2. 熟悉深度学习基础与主流生成式模型,了解 Transformer、Diffusion、VAE、视频生成或时序建模等方向; 4. 具备机器人操作、模仿学习、强化学习、…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1. 负责机器人操作世界模型算法研发,包括视频预测、状态建模、动作生成、潜在空间建模等核心技术; 2. 参与 VLA 模型训练与优化,探索世界模型在长时序操作、多任务泛化与复杂场景推理中的应用; 3. 参与类似 DreamZero、FastWAM 等生成式机器人算法方向研究,探索基于视频生成与未来状态预测的机器人动作规划与控制能力; 4. 构建机器人操作评估与数据闭环系统,推动模型在真实机器人上的部署验证与 sim2real 泛化; 5. 跟踪世界模型、机器人基础模型、强化学习与多模态生成模型等前沿方向,完成相关算法复现、优化与创新。
包括英文材料
深度学习+
https://d2l.ai/
Interactive deep learning book with code, math, and discussions.
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
还有更多 •••
相关职位

实习算法序列
1、基于Isaac Sim / IsaacLab 进行机器人任务仿真环境构建与维护 2、参与仿真数据合成与数据管线优化 3、搭建VLA模型的仿真评测流程,参与 benchmark 设计与实现 4、与算法/模型团队协作,定位仿真与真实行为之间的差异
更新于 2026-01-23上海
社招3年以上机器人大模型技术
1.探索前沿系统架构,推动灵巧手在手内操作及通用、功能型操作的发展(包括不同刚柔物体在手内与环境的交互); 2.开发适用于机器人灵巧操作的机器学习模型与端到端应用; 3.创新机器人感知与智能方法,利用多模态感知(如图像、视频、音频、触觉等)赋能灵巧操作与控制算法; 4.开发高效可部署的机器人模型,并推动研究成果集成到完整系统级机器人原型中。
更新于 2026-03-24深圳