快手大模型应用算法工程师-快意
社招全职3-5年J0011地点:北京状态:招聘
任职要求
1、本硕博学历均可;计算机、人工智能、数学相关专业; 2、有较强的工程实现能力,熟悉LLM及MLLM基本原理、大模型微调/RLHF等技术,熟悉C/C++、Python、Java等至少一门主流编程语言; 3、对计算机视觉、自然语言处理、多模态、知识图谱、机器学习等相关领域有深入的理解,且有相关实际项目经验; 4、对学术前沿有浓厚兴趣,时刻跟进技术前沿,…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1、负责通过基于大语言模型及多模态大模型的微调、prompts调优、指令构建及演化技术,将大模型的生成、理解、交互能力在公司核心业务场景应用落地,包括但不限于AIGC创意生成、视频处理、智能化特效、智能对话、代码生成、音视频传输、电商场景内容理解等; 2、负责LLM及多模态大模型的应用中台及相关技术模块搭建,包括但不限于Agents 、RAG、 function call、system prompts等,探索大模型应用前沿及新兴应用场景; 3、跟踪行业及大模型技术发展,结合业界前沿技术和业务需求,打造大模型应用的最佳实践; 4、了解业务,与公司各技术团队密切配合,能与产品、运营等角色高效沟通需求和目标,发挥自己的主观能动性,设计技术解决方案,培养自己的良好的业务sense和综合素质。
包括英文材料
学历+
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
RLHF+
[英文] What is RLHF?
https://aws.amazon.com/what-is/reinforcement-learning-from-human-feedback/
Reinforcement learning from human feedback (RLHF) is a machine learning (ML) technique that uses human feedback to optimize ML models to self-learn more efficiently.
https://www.ibm.com/think/topics/rlhf
Reinforcement learning from human feedback (RLHF) is a machine learning technique in which a “reward model” is trained with direct human feedback, then used to optimize the performance of an artificial intelligence agent through reinforcement learning.
C+
https://www.freecodecamp.org/chinese/news/the-c-beginners-handbook/
本手册遵循二八定律。你将在 20% 的时间内学习 80% 的 C 编程语言。
https://www.youtube.com/watch?v=87SH2Cn0s9A
https://www.youtube.com/watch?v=KJgsSFOSQv0
This course will give you a full introduction into all of the core concepts in the C programming language.
https://www.youtube.com/watch?v=PaPN51Mm5qQ
In this complete C programming course, Dr. Charles Severance (aka Dr. Chuck) will help you understand computer architecture and low-level programming with the help of the classic C Programming language book written by Brian Kernighan and Dennis Ritchie.
C+++
https://www.learncpp.com/
LearnCpp.com is a free website devoted to teaching you how to program in modern C++.
https://www.youtube.com/watch?v=ZzaPdXTrSb8
Python+
https://liaoxuefeng.com/books/python/introduction/index.html
中文,免费,零起点,完整示例,基于最新的Python 3版本。
https://www.learnpython.org/
a free interactive Python tutorial for people who want to learn Python, fast.
https://www.youtube.com/watch?v=K5KVEU3aaeQ
Master Python from scratch 🚀 No fluff—just clear, practical coding skills to kickstart your journey!
https://www.youtube.com/watch?v=rfscVS0vtbw
This course will give you a full introduction into all of the core concepts in python.
还有更多 •••
相关职位
实习高德研究型实习生
1、意图理解: 基于用户输入、历史上下文以及环境信息,理解用户真实意图、完成多轮改写query以及任务难度识别,提升识别&分流准确率。 2、Function-call:抽象并整合内外部服务能力为工具,训练大模型理解以及使用工具能力,解决用户需求,提升工具使用及参数提取准确率。 3、生成式推荐: 基于海量用户session行为,通过大模型挖掘用户长短期潜在意图以及需求,并预测用户后续行为,提升各场景引导入口CTR。 4、跟踪业界最新研究技术以及成果,并应用到实际产品中;
更新于 2025-12-05北京
实习核心本地商业-业
1. 基于海量数据,利用机器学习、深度学习算法,深入理解平台治理,实现风险数据的自动化分析与挖掘; 2. 结合行业特点利用大模型技术,应用到价格治理、商户治理等业务环节中,持续跟踪和评估模型效果; 3. 结合业务特点,进行模型和算法创新,打造业界先进的平台治理算法体系。
更新于 2026-01-22北京
社招2年以上核心本地商业-基
1. 负责客服场景大模型微调(SFT)及强化学习(RLHF/RLAIF/DPO),持续提升模型在复杂业务逻辑下的推理能力与回复质量。 2. 深度优化RAG链路,包括Embedding模型精调、多路召回融合、重排序及长文本处理,将海量非结构化知识库转化为精准的业务生产力。 3. 参与沙盒模拟/红蓝对抗体系建设,通过对抗模拟和自动化评测,挖掘模型潜在问题,驱动模型实现智能化自迭代。 4. LLM在交互安全、自动判责、智能质检、复杂任务编排(Agentic Workflow)等高价值场景的落地,实现客服全流程的智能化转型。
更新于 2026-07-15北京|上海