logo of kuaishou

快手(大模型专项)AI大模型对话专家/工程师

社招全职5-10年D13925地点:北京状态:招聘

任职要求


1、硕士以上学历,计算机相关专业,领域相关优秀学校优先;
2、基础数据结构与代码能力扎实,熟悉机器学习和深度学习的基础知识和常用框架;
3、有NLP与…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


近日,大模型相关技术呈现出爆发式发展,AI技术正在成为新一轮革命的焦点,可以预见会对广泛的社会生产力和用户消费体验带来深远的影响。作为全球领先的短视频和直播平台,快手AI团队在多媒体AI领域有多年的技术和应用积累。大模型、AIGC等AI技术作为公司发展的关键技术方向,将长期重点投入,保障相关技术创新的突破及业务落地。

1、LLM模型应用落地:参与LLM在公司内部的应用,探索LLM的创新落地场景;
2、算法研究与开发: 参与大模型相关算法研究与开发工作,提升模型性能和算法效率,关注并跟进学术界的最新进展;
3、技术优化与创新: 持续优化现有的算法技术,推动算法创新,不断业务效果和用户体验;
4、跨团队合作: 与产品团队、工程团队和业务团队紧密合作,理解业务需求,将算法技术转化为实际的产品和解决方案;
5、算法评估与改进: 负责对算法模型进行评估和改进,提高算法的准确性、效率和可解释性。
包括英文材料
学历+
数据结构+
机器学习+
还有更多 •••
相关职位

logo of aliyun
社招技术类-算法

岗位职责: 该职位通过大模型训练、Agent、RAG、N2SQL、NLP、语音处理等技术创新和突破,构建Agent通用平台、大模型训练平台等工具产品,同时支持对话机器人等垂直应用及智能产品的建设。欢迎敢于接受挑战的候选人加入我们,一起赋能企业客户。我们的研究方向包括但不限于: 1、通用大模型、推理大模型预训练、微调、强化对齐等技术的持续研究创新; 2、多语言大模型、领域大模型的训练技术研究与落地; 3、AI数据清洗、加工、合成、自动标注技术研究与落地; 4、文本机器人、语音机器人、质检机器人等客服域技术的研发与落地; 5、多Agent、RAG、N2SQL、自主决策等技术的研究与落地; 6、入呼大模型机器人、外呼大模型机器人研发经验;熟悉VAD, ASR, TTS等语音相关技术; 以上方向擅长其中1个即可

更新于 2025-06-10北京|杭州
logo of alibaba
社招2年以上

关于我们 我们致力于把大模型 Agent 打造成“能解决业务问题的生产力系统”:不仅会对话,更能规划、推理、调用工具、洞察数据,在多个业务场景形成端到端闭环。团队长期坚持“学术先进性 + 工程可落地 + 指标可验证”三位一体,推动多项技术在真实业务中规模化应用,并持续输出可复用的训练与评测体系。 你将获得什么 ● 覆盖多模型、多尺寸的系统化训练能力:团队训练资源充足,能在不同架构/不同规模模型上完成微调、对齐与能力专项提升,并形成可复用的训练范式。 ● 论文级问题 + 业务级验证:我们鼓励你做可发表的创新,同时确保每个方向都能进入线上评测与业务闭环,真正做到 有创新、有落地、有收益。 ● 完整的 Agent RL 研发舞台:从环境构建、Reward 设计、策略优化到自动评估工具链,你将能主导一条完整的 RL-Driven Agent 能力演进路径。 ● 个人影响力与成长:支持对外分享、论文/专利沉淀与跨团队共建 岗位职责 1、主导基于大模型的 AI Agent 全生命周期研发,包括通用型及垂直领域 AI Agent 的应用架构设计、数据构建、模型训练与评测; 2、运用 SFT、RL 等 Post-training 训练方法,提升大模型在自主规划(Planning)、多步推理、RAG 增强生成、工具调用、数据问答等方面的能力; 3、构建 Agent RL 所需的环境与训练方法,设计合理的 Reward Function 和优化函数,激发模型在垂直领域内的泛化性,探索无/少人类专家样本依赖的 Agent 优化方案; 4、跟踪 LLM 与 Agent 领域的国际前沿技术动态,推动技术创新在业务场景中的落地应用,重点突破工具集成复杂推理、数据洞察、AI 搜索等方向的应用创新; 5、持续优化 Agent 算法与系统架构,构建端到端智能体评测体系,开发自动化评估工具与多维评价指标,提升系统性能与效率。

更新于 2026-01-28杭州
logo of dingtalk
社招3年以上技术类-算法

语音是人机交互中最自然、最便捷的模态。随着大模型时代的到来,语音 AI 正在从单一的任务处理向多模态、高自然度的“数字员工”演进。 在我们这里,RTC 不仅仅是传输管道,而是数字人的神经中枢。我们已经打通了 WebRTC 全链路,并实现了打断、轮次检测等核心能力。现在的目标是攻克 极致交互延迟、拟人化情感合成、以及具备 RAG 与工具调用能力的语音 Agent。加入我们,你将亲手打造一个“听得清、反应快、有记忆、能办事”的数字灵魂。我们倡导 AI-First 的开发哲学,鼓励利用 AI Coding 与 Vibe Coding 的新范式,快速将创意转化为亿万级用户的交互体验。 【岗位职责】 1. 全链路算法研发与优化: ○ 负责 ASR/LLM/TTS 全链路的协同优化。通过流式算法(Streaming)与端到端优化,挑战 RTC 场景下人机对答的物理延迟极限。 2. 语音 Agent 大脑构建: ○ RAG 与知识增强: 集成检索增强生成(RAG)技术,提升数字人在垂直领域(如医疗预约、智能客服)的专业度。 ○ 实时任务编排: 研发高可靠的 Tool Use(工具调用) 逻辑,使数字人能实时操作后台系统,并处理调用过程中的长延迟等待与交互反馈。 ○ 记忆管理: 建立长短期记忆系统,确保数字人在多轮复杂对话中保持语境一致性。 3. 专项技术突破: ○ 高鲁棒性交互: 研发基于深度学习的智能 VAD 与“语义打断”逻辑,解决强噪声及复杂环境下的起停点识别痛点。 ○ 拟人化表达: 微调 TTS 模型(如情感自适应、口语化重写),提升音色的情感表现力与韵律感。 4. 模型工程化落地: 推动算法在 GPU 环境下的高性能部署,优化并发场景下的状态机管理、显存调度及异常重试机制。 5. 前沿预研: 跟踪并实践 Speech-to-Speech (S2S) 原生端到端交互,探索大模型驱动的语音多模态融合方案;跟踪并实践两段式(ASR+多模态/多模态+TTS)低延迟交互。

更新于 2026-03-24杭州
logo of kuaishou
社招3年以上D13912

1、跟进国内外前沿的AI生成模型及产品的最新动态,能够及时对AIGC领域的技术产品和应用进行市场调研和趋势分析; 2、负责公司AIGC相关技术产品(大规模语言模型及多模态AI生成能力)的数据规范定义、下游任务设计及场景明确,负责相关技术产品的产品架构设计、发展规划、实施路径拆解及项目管理; 3、负责AIGC技术在快手各业务线的落地和应用,跟进重点业务项目的需求分析和实施落地,能够与数据、算法、工程、业务等团队充分协作、高效沟通,保证项目按时保质完成交付; 4、从产品应用角度对AIGC的多种模型能力制定合理、全面的评估方案,关注业界相关能力,并基于使用情况进行效果监测和模型优化方向反馈 ; 5、负责AIGC相关技术的场景化应用的方案设计及展示平台设计。

更新于 2025-05-20北京