vivoVLA强化学习算法工程师-27届秋招
校招全职地点:东莞状态:招聘
工作描述
任职要求 1、硕士及以上学历,计算机科学与技术、自动化、控制工程等相关专业,有机器人相关研发经验,了解VLA和世界模型等操作模型,有真机落地项目经验者优先; 2、深入理解主流强化学习算法(PPO、GRPO、SAC、BCQ等)原理与实现,有独立的算法研发与优化经验; 3、熟练掌握至少一种主流机器人仿真平台(NVIDIA Isaac Sim/Isaac Lab、MuJo…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
算法+
https://roadmap.sh/datastructures-and-algorithms
Step by step guide to learn Data Structures and Algorithms in 2025
https://www.hellointerview.com/learn/code
A visual guide to the most important patterns and approaches for the coding interview.
https://www.w3schools.com/dsa/
还有更多 •••
相关职位

实习算法序列
1、硕士及以上学历,专业方向为计算机科学、自动化、机器人学或相关领域; 2、具备较强的研究能力与沟通能力,具有强烈的自驱力、责任心和团队合作精神,能独立思考并完成工作; 3、具有机器人操作算法训练经验
更新于 2026-01-28北京
校招
1、计算机科学与技术、自动化、控制工程等相关专业,2 年及以上机器人相关研发经验,熟悉VLA、世界模型、强化学习等操作模型,有真机落地项目经验者优先; 2、深入理解主流VLA算法(PI系列、RT系列、
更新于 2026-06-17东莞
实习
1、学历与专业: 计算机、自动化、机器人、人工智能、数学等相关专业,硕士及以上学历 2、有端到端自动驾驶(如UniAD)或VLA模型(如RT-2)等在机器人/自动驾驶领域的应用经验; 3、具备良好的数
更新于 2026-07-16深圳