快手游戏 AI 算法工程师(强化学习方向)-【游戏事业部】
社招全职3-5年J0011地点:杭州状态:招聘
任职要求
1、计算机、人工智能、数学等相关专业硕士及以上学历,具备扎实的机器学习和强化学习基础; 2、熟悉强化学习算法(如 DQN、PPO、SAC、A3C)及其在游戏 AI 领域的应用; 3、2年以上相关工作经验,包括但不限于使用强化学习、模仿学习、LLM等相关技术,参与游戏AI、无人驾驶等决策控制类业务…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1、研究并应用强化学习(RL)技术在游戏场景中的创新应用,如 NPC 行为学习、自适应游戏策略、自动化测试等; 2、负责开发基于 RL 的智能体决策、路径规划、多智能体协作等算法; 3、结合 LLM、计算机视觉等技术,提升游戏 AI 的决策能力和可玩性; 4、负责强化学习模型的训练、优化和部署,提升游戏 AI 的自主学习能力; 5、跟踪强化学习在游戏领域的最新研究,并结合游戏项目进行创新探索; 6、 持续改进算法和框架,开发和完善通用框架和SDK工具,提升游戏AI开发效率。
包括英文材料
学历+
机器学习+
https://www.youtube.com/watch?v=0oyDqO8PjIg
Learn about machine learning and AI with this comprehensive 11-hour course from @LunarTech_ai.
https://www.youtube.com/watch?v=i_LwzRVP7bg
Learn Machine Learning in a way that is accessible to absolute beginners.
https://www.youtube.com/watch?v=NWONeJKn6kc
Learn the theory and practical application of machine learning concepts in this comprehensive course for beginners.
https://www.youtube.com/watch?v=PcbuKRNtCUc
Learn about all the most important concepts and terms related to machine learning and AI.
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
算法+
https://roadmap.sh/datastructures-and-algorithms
Step by step guide to learn Data Structures and Algorithms in 2025
https://www.hellointerview.com/learn/code
A visual guide to the most important patterns and approaches for the coding interview.
https://www.w3schools.com/dsa/
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
还有更多 •••
相关职位
社招3-5年网易游戏(互娱)
- 参与强化学习、模仿学习、进化算法的落地工作,包括但不限于智能体、平衡性测试等; - 基于强化学习、模仿学习等AI技术为游戏产品打造更强力、更多样、更拟人的AI机器人; - 参与开发强化学习训练和部署平台
更新于 2026-07-28杭州

社招1-3年程序质量
1、负责游戏场景下大模型的后训练算法研究与开发,包括但不限于SFT、RLHF、DPO等,提供端到端的AI技术解决方案; 2、负责前沿模型技术与Agent能力的探索调研、实验与开发,并且推进在游戏场景内落地; 3、负责梳理与搭建算法训练与上线相关的工程管线,建立稳定可复用的实验与落地环境。
更新于 2026-03-27珠海
社招J0011
业务场景: 探索大语言模型技术在游戏内容生产、AI游戏与智能NPC场景的落地应用,研发垂直领域的LLMs,为游戏业务提供智能化的内容生产能力,提高游戏资产制作效率。 相关工作: 1、LLMs微调技术框架开发:负责LLMs模型的研究与开发,基础模型训练,监督微调和强化训练,包括但不限于模型选型,数据处理,效果评估和优化,形成一套完整的链路,用LLMs构建垂类场景中模型基座,提升效果的可靠性和一致性; 2、LLMs系统应用研发:基于业务需求与业务数据,与产品,策划,服务端同事一起将LLMs的能力应用于游戏NPC智能对话交互,肢体动作生成,游戏剧情/动画生产等,能够主导模型的研发,训练数据处理与模型的工程化部署整体环节; 3、AI助力游戏方面的探索,包括不限于:AIGC,AI辅助工具开发等。
更新于 2025-07-21杭州