快手【留用实习】大模型推理/训练引擎研发工程师
任职要求
1、本科以上学历,电子、自动化、计算机类专业优先; 2、了解分布式系统或高性能计算相关知识,具备良好的系统编程、数据结构、算法基础、系统设计能力; 3、熟悉Linux开发环境、熟练使用Pytorch训练框架,掌握 C++/Python编程语言; 4、具有良好的团队合作精神和沟通能力。热爱钻研技术,善于分析、解决工程问题,能够对算法和底层的协同优化起到核心桥梁作用。 加分项: 1、熟悉t…
工作职责
1、参与快手大规模深度学习推理引擎、大模型训练解决方案的研发与优化,包括大模型推理、模型训练框架、微调平台等; 2、参与底层算子的优化、通过优化访存pattern、计算提升推理性能,与算法部门合作,为公司大模型定制训练方案,探索RLHF、MoE、多模态、longcontext等前沿方向,提升训练性能; 3、优化推理框架上层调度策略,通过机内、机间的计算任务调度和通讯优化提升引擎性能;优化现有大语言模型相关工具和平台,提高模型训练、维护效率,降低成本,提升训练服务稳定性。
1、负责通过基于大语言模型及多模态大模型的微调、prompts调优、指令构建及演化技术,将大模型的生成、理解、交互能力在公司核心业务场景应用落地,包括但不限于AIGC创意生成、视频处理、智能化特效、智能对话、代码生成、音视频传输、电商场景内容理解等; 2、负责LLM及多模态大模型的应用中台及相关技术模块搭建,包括但不限于Agents 、RAG、 function call、system prompts等,探索大模型应用前沿及新兴应用场景; 3、跟踪行业及大模型技术发展,结合业界前沿技术和业务需求,打造大模型应用的最佳实践; 4、了解业务,与公司各技术团队密切配合,能与产品、运营等角色高效沟通需求和目标,发挥自己的主观能动性,设计技术解决方案,培养自己的良好的业务sense和综合素质。
1、参与 Agent 核心运行时的各项能力建设,包括任务规划、工具调用、记忆管理、多智能体协同等关键模块; 2、参与 OpenClaw 等开源 Agent 产品在快手内部的工程化落地与能力增强,包括电商、直播、短视频等业务场景; 3、参与 Agent 系统的可观测、评测、稳定性与部署体系建设,提升复杂 AI 系统的线上可用性; 4、跟踪并验证前沿 Agent / AI Infra 技术演进,推动从技术探索到业务落地的闭环。
1、基于大语言模型及多模态大模型的微调、prompts调优、指令构建及演化技术,将大模型的生成、理解、交互能力在公司核心业务场景应用落地,包括但不限于智能对话系统、电商内容理解等; 2、参与LLM及多模态大模型的应用中台及相关技术模块搭建,包括但不限于Agents 、RAG、 function call、system prompts等,探索大模型应用前沿及新兴应用场景; 3、跟踪行业及大模型技术发展,结合业界前沿技术和业务需求,打造大模型应用的最佳实践; 4、了解业务,与公司各技术团队密切配合,能与产品、运营等角色高效沟通需求和目标,发挥自己的主观能动性,设计技术解决方案,培养自己良好的业务sense和综合素质。
1、负责大模型在广告应用场景落地的相关工作;结合大模型的生成理解能力,将大模型prompts调优、RAG应用、大模型对齐微调、RLHF等技术在广告核心业务场景落地,提高广告模型的匹配效率,推动业务高速发展; 2、负责多模态技术在广告应用场景落地的相关工作;结合多模态表征学习、diffusion等生成式建模方法,提高广告模型的跨域理解能力; 3、跟踪AI行业及大模型技术发展,结合业界前沿技术和业务需求,不断推进广告算法设计升级; 4、了解业务,与公司各技术团队密切配合,能与产品、运营等角色高效沟通需求和目标,发挥自己的主观能动性,设计技术解决方案,培养自己的良好的业务sense和综合素质。