阿里巴巴算法研究员-Agentic多模态生成
实习兼职阿里巴巴日常实习生地点:杭州状态:招聘
工作描述
任职要求 1. 学历背景:计算机、人工智能、数学、电子信息等相关专业在读硕士或博士,具备扎实的深度学习、强化学习及概率统计基础。 2. 熟练掌握 Python 及主流深度学习框架(PyTorch/TensorFlow)。 3. 在生成式模型(Diffusion, Transformer, GANs)、强化学习(PPO, DPO, RLHF) 或 大语言模型 Agent 开发 任一领域有深入理解或项目经验。 4. 拥有优秀的代码工程能力,能够处理大规模数据训练及复杂工作流的系统搭建。 5. 综合素质:对 AIGC 赋能 B 端业务充满热情,具备极强的创新思维和问题解决能力,有顶会论文发表或知名开源项目贡献者加分。 工作职责 一、关于阿里巴巴国际站 阿里巴巴国际站是全球领先的跨境 B2B 数字贸易平台,致力于推动全球贸易数字化升级。在这里,你将有机会深入 AIGC 在垂直领域的“深水区”,直接参与构建懂业务、能推理的Agentic Creative System(智能创意系统),用前沿的生成式 AI 技术重塑全…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
深度学习+
https://d2l.ai/
Interactive deep learning book with code, math, and discussions.
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
Python+
https://liaoxuefeng.com/books/python/introduction/index.html
中文,免费,零起点,完整示例,基于最新的Python 3版本。
https://www.learnpython.org/
a free interactive Python tutorial for people who want to learn Python, fast.
https://www.youtube.com/watch?v=K5KVEU3aaeQ
Master Python from scratch 🚀 No fluff—just clear, practical coding skills to kickstart your journey!
https://www.youtube.com/watch?v=rfscVS0vtbw
This course will give you a full introduction into all of the core concepts in python.
PyTorch+
https://datawhalechina.github.io/thorough-pytorch/
PyTorch是利用深度学习进行数据科学研究的重要工具,在灵活性、可读性和性能上都具备相当的优势,近年来已成为学术界实现深度学习算法最常用的框架。
https://www.youtube.com/watch?v=V_xro1bcAuA
Learn PyTorch for deep learning in this comprehensive course for beginners. PyTorch is a machine learning framework written in Python.
还有更多 •••
相关职位
实习阿里巴巴日常实习
1、核心负责商家侧 Agent 框架研发,设计可编排的 Skill/Tool/Memory 机制,支撑多商家个性化配置与建模。重点探索 Agentic RL(PPO/GRPO 等),开展奖励设计、信用
更新于 2026-07-08杭州
实习阿里巴巴研究型实
1、研究经历:具备大模型 post-training / 强化学习方向的研究经验,至少一篇顶会一作论文(NeurIPS / ICML / ICLR / ACL 等)。 2、系统理解:熟悉 Agent
更新于 2026-08-21杭州
校招程序&技术类
1.具备大语言模型数据研发相关工作经验; 2.熟悉大模型完整训练链路,包含预训练、中段训练、后训练阶段; 3.具备agent模型训练与评测实操经验; 4.有 agentic, reasoning, c
上海|北京