贝壳全模态算法工程师(Agent方向)【2026届春招】(J70241)
校招全职算法类地点:北京状态:招聘
工作描述
任职要求 1、硕士及以上学历,毕业时间:2025年9月-2026年8月,计算机、人工智能、软件工程等相关专业; 2、扎实的自然语言处理与深度学习理论基础,熟悉Transformer等主流大模型架构及训练机制,理解预训练与对齐范式; 3、具备大语言模型微调与对齐优化实战经验,包括 SFT、RLHF、DPO 等方法,有完整训练、调参与效果优化经验者优先; 4、熟悉LLM Agent相关核心技术,包括但不限于: * Prompt Engineering 与自动化Prompt优化 * RAG(检索增强生成)与知识增强机制 * Tool Use / Function Callin…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
学历+
NLP+
https://www.youtube.com/watch?v=fNxaJsNG3-s&list=PLQY2H8rRoyvzDbLUZkbudP-MFQZwNmU4S
Welcome to Zero to Hero for Natural Language Processing using TensorFlow!
https://www.youtube.com/watch?v=R-AG4-qZs1A&list=PLeo1K3hjS3uuvuAXhYjV2lMEShq2UYSwX
Natural Language Processing tutorial for beginners series in Python.
https://www.youtube.com/watch?v=rmVRLeJRkl4&list=PLoROMvodv4rMFqRtEuo6SGjY4XbRIVRd4
The foundations of the effective modern methods for deep learning applied to NLP.
深度学习+
https://d2l.ai/
Interactive deep learning book with code, math, and discussions.
Transformer+
https://huggingface.co/learn/llm-course/en/chapter1/4
Breaking down how Large Language Models work, visualizing how data flows through.
https://poloclub.github.io/transformer-explainer/
An interactive visualization tool showing you how transformer models work in large language models (LLM) like GPT.
https://www.youtube.com/watch?v=wjZofJX0v4M
Breaking down how Large Language Models work, visualizing how data flows through.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
SFT+
https://cameronrwolfe.substack.com/p/understanding-and-using-supervised
Understanding how SFT works from the idea to a working implementation...
RLHF+
[英文] What is RLHF?
https://aws.amazon.com/what-is/reinforcement-learning-from-human-feedback/
Reinforcement learning from human feedback (RLHF) is a machine learning (ML) technique that uses human feedback to optimize ML models to self-learn more efficiently.
https://www.ibm.com/think/topics/rlhf
Reinforcement learning from human feedback (RLHF) is a machine learning technique in which a “reward model” is trained with direct human feedback, then used to optimize the performance of an artificial intelligence agent through reinforcement learning.
还有更多 •••
相关职位
实习算法类
1、硕士及以上学历,毕业时间:2026年9月-2027年8月,计算机、人工智能、软件工程等相关专业; 2、扎实的自然语言处理与深度学习理论基础,熟悉Transformer等主流大模型架构及训练机制,理
更新于 2026-06-02北京
社招3年以上云智能集团
1、计算机、人工智能等相关专业硕士/博士学位,在语音处理、多模态学习、大模型后训练等领域具备扎实的理论基础; 2、实战经验与工程能力: ● 有实际落地语音或音视频多模态项目经验,能处理真实场景
更新于 2026-03-23北京|杭州
社招算法开发岗
1.硕士及以上学历,计算机、具身智能、高性能物理、数学、人工智能及STEM等相关专业; 2.拥有扎实的计算机科学功底和编程能力,熟悉VLM/Omini/VLA/World Model/Flow Mat
更新于 2026-01-20北京