蚂蚁金服【转正实习】算法工程师-智能体
实习兼职蚂蚁集团2027届转正实习地点:北京 | 上海 | 杭州状态:招聘
任职要求
1. 计算机科学、人工智能等相关专业本科及以上学历; 2. 编程基础扎实,熟练掌握Python;对大模型(如Transformer)的基本原理有良好理解。 3. 对AI Agent、强化学习等技术领域有浓厚兴趣,具备优秀的逻辑分析能力和快速学习能力。 4. 积极关注并体验各类前沿AI应用,对大模型的能力边界有自己的思考和见解。 【…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1. Agent核心算法研发:负责AI智能体(Agent)核心算法的设计与实现,包括任务规划、记忆管理、工具调用等模块,并探索强化学习(RL)在其中的应用。 2. 模型优化与对齐:应用SFT、RLHF等对齐技术,负责模型输出的逻辑校验与“幻觉”缓解,提升Agent决策的准确性与可靠性。 3. 性能与推理优化:研究并应用量化、并行计算等技术,优化大模型推理效率,提升Agent的响应速度与运行性能。 4. 框架开发与原型验证:参与Agent框架的开发、测试与迭代,并快速将前沿算法思想转化为可交互的产品原型。 5. 大模型和产品结合:创建产品和模型训练之间的数据飞轮,构建产学研的轮转迭代。 6. 基于执行反馈的学习算法研发:使AI系统能够从实践中学习并生成更有效的训练算法,深入理解奖励函数设计、探索-利用平衡以及如何避免多样性崩溃等关键问题。
包括英文材料
学历+
Python+
https://liaoxuefeng.com/books/python/introduction/index.html
中文,免费,零起点,完整示例,基于最新的Python 3版本。
https://www.learnpython.org/
a free interactive Python tutorial for people who want to learn Python, fast.
https://www.youtube.com/watch?v=K5KVEU3aaeQ
Master Python from scratch 🚀 No fluff—just clear, practical coding skills to kickstart your journey!
https://www.youtube.com/watch?v=rfscVS0vtbw
This course will give you a full introduction into all of the core concepts in python.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
AI agent+
https://www.ibm.com/think/ai-agents
Your one-stop resource for gaining in-depth knowledge and hands-on applications of AI agents.
强化学习+
https://cloud.google.com/discover/what-is-reinforcement-learning?hl=en
Reinforcement learning (RL) is a type of machine learning where an "agent" learns optimal behavior through interaction with its environment.
https://huggingface.co/learn/deep-rl-course/unit0/introduction
This course will teach you about Deep Reinforcement Learning from beginner to expert. It’s completely free and open-source!
https://www.kaggle.com/learn/intro-to-game-ai-and-reinforcement-learning
Build your own video game bots, using classic and cutting-edge algorithms.
还有更多 •••
相关职位
实习蚂蚁集团2027
你是整个集团广告/推荐/搜索引擎平台和业务背后的支持者; 是驱动商业变革的多项领先算法技术的核心引擎。 在这里你可以: 面向蚂蚁的科技服务平台,基于大数据、大规模分布式集群计算环境,进行机器学习建模; 算法产品化建设,参与模型在线实时计算框架开发落地; 算法研究和创新,结合实际业务需求,抽象算法问题,给出创新方案; 算法效果迭代改进,进行特征工程开发及应用; 支持各种深度学习网络的灵活拆分; 支持超TB的模型,驱动异构计算和实时计算的发展; 深度学习当前重点发展的图表征学习、网络的灵活拆分、超TB的模型、驱动异构计算和实时计算,不断追求效率的极致; 借助已有的该领域密切相关的技术方向丰满自己! 我们正在定义大数据AI技术的未来,欢迎加入算法人的理想国~
北京|上海|杭州
实习蚂蚁集团2027
1. 研发和探索多模态内容理解或生成算法(文本/图像/声音/视频等),并应用于搜索推荐、内容生成、智能交互等核心业务中; 2. 提出和实现业界领先的多模态算法创新,包括但不限于多模态预训练、多模态大模型、多模态表征学习等等,并应用到核心业务中。
北京|上海|杭州
实习蚂蚁集团2027
1.负责以大模型为代表的AI技术能力的建设和优化,打造业界领先的AI技术系统,主要职责包括AI系统结构设计、RAG 系统开发、大模型训练数据构建、大模型能力评测、大模型推理效果和效率优化等; 2.紧密跟踪、探索大模型方向前沿技术,依托丰富且体系化的业务生态,实践大模型算法的创新应用与落地。
北京|上海|杭州