阿里巴巴日常实习生-1688-大模型应用算法
实习兼职阿里巴巴日常实习生地点:杭州状态:招聘
工作描述
任职要求 * 计算机、人工智能、数学等相关专业在读(本科大三及以上 / 硕士 / 博士),可实习 3 个月以上。 * 熟悉 Transformer、LLM 基础原理,了解 SFT / RLHF / RAG / Agent 等主流技术范式之一。 * 具备扎实的 Python 编码能力,熟悉至少一个主流框架(LangChain …
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
SFT+
https://cameronrwolfe.substack.com/p/understanding-and-using-supervised
Understanding how SFT works from the idea to a working implementation...
RLHF+
[英文] What is RLHF?
https://aws.amazon.com/what-is/reinforcement-learning-from-human-feedback/
Reinforcement learning from human feedback (RLHF) is a machine learning (ML) technique that uses human feedback to optimize ML models to self-learn more efficiently.
https://www.ibm.com/think/topics/rlhf
Reinforcement learning from human feedback (RLHF) is a machine learning technique in which a “reward model” is trained with direct human feedback, then used to optimize the performance of an artificial intelligence agent through reinforcement learning.
RAG+
https://www.youtube.com/watch?v=sVcwVQRHIc8
Learn how to implement RAG (Retrieval Augmented Generation) from scratch, straight from a LangChain software engineer.
还有更多 •••
相关职位
社招1-3年J0011
1、计算机、统计学、数学或相关专业硕士及以上学历,具备丰富的机器学习、计算机视觉等项目经验,拥有扎实的数据分析与建模基础; 2、在以下至少一个方向有深厚的项目经验和技术洞察力:视频质量评价、多模态内容
更新于 2026-05-26北京
实习阿里巴巴2027
1、精通 Transformer、Diffusion 等主流开源多模态模型,以及训练框架; 2、有过10B以上模型参数量、10T以上数据量、以及千卡规模训练经验; 3、有丰富的NLP和CV领域的积累,
更新于 2026-03-17北京|杭州
实习
岗位职责(具体工作内容) 数据分析师/AI产品方向 岗位职责: 1. 产品埋点体系搭建:负责产品埋点设计, 持续完善全产品链路数据建设; 2. 搭建实验核心业务数据监控体系,追踪产品关键指标; 3.
更新于 2026-09-09北京