蚂蚁金服【蚂蚁星】算法工程师-强化学习-大安全-27届
校招全职2027届蚂蚁星- Plan A人才计划地点:北京状态:招聘
工作描述
任职要求
1. 计算机 / AI 相关方向博士在读或应届,研究方向覆盖以下至少1项:数据合成(SDV / TabDDPM / TabSyn 等)、强化学习与多目标优化、自博弈与对抗学习;
2. 在顶会有一作,或在数据合成、对抗学习方向有顶会 benchmark 成绩 / 主导过有影响力开源项目;
3. 熟悉 RLHF / DPO / Constitutional AI 路线,对 re…登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
还有更多 •••
相关职位
实习蚂蚁星- Pla
1. 计算机 / AI 相关方向博士在读或应届,研究方向覆盖以下至少1项:数据合成(SDV / TabDDPM / TabSyn 等)、强化学习与多目标优化、自博弈与对抗学习; 2. 在顶会有一作,或
更新于 2026-05-13北京
实习蚂蚁星- Pla
1.学术背景:计算机科学、人工智能、机器学习等相关专业硕士/博士学位,具有扎实的理论基础与研究能力; 2.LLM原理与推理优化经验:深入了解LLM的底层原理,熟悉量化、投机推理等推理优化技术,能够在团
更新于 2026-05-12上海
实习蚂蚁星- Pla
1.深入理解Transformer、大模型原理,熟练掌握Python; 2.Agent实战经验:独立实现过Agent架构,理解长期记忆、工具调用准确率、多步规划等核心挑战。踩过Agent的坑——比如工
更新于 2026-05-12上海