快手【快Star-X实习】计算机视觉算法工程师
任职要求
1、硕士及以上学历,计算机和数学相关专业,熟悉CV相关领域的前沿算法,具备扎实的数学和算法功底; 2、熟练掌握Python及C/C++等编程语言,熟练掌握常用的深度学习模型结构及训练方法; 3、优秀的沟通能力和团队意识,热爱学习,责任感强。 加分项: 1、以第一作者在CV/CG/AI/ML顶级会议或期刊发表过论文; 2、以核心成员获得过知名AI/编程/数学竞赛名次; 3、有丰富的计算机视觉相关项目落地经验或开源项目经验。
工作职责
1、推进计算机视觉技术前沿探索,与这里经验丰富的技术同学一起,完成领先的新算法模型,解决业界新问题。 2、参与计算机视觉和人工智能的前沿技术研究工作,研究方向包括但不限于分类/检测/分割、多模态、视觉基础模型、3D视觉、AIGC、人像美化等方向。
1、负责研发基于diffusion的low-level视频处理算法,专注于提升算法性能,包括但不限于网络架构设计、算法优化、大规模数据处理以及Diffusion模型保真性提升; 2、负责研发基于diffusion的视频压缩和生成框架,致力于突破视频生成极限,涉及图像/视频压缩算法的创新设计和优化; 3、持续关注并分析国际前沿的AI技术动态,将最新的处理及编解码技术融入现有模型,为研发下一代基于AI的高效视频处理系统提供技术基础。
1、打造最适合短视频、直播、搜索推荐、电商、创作者玩法的多模态大模型,为快手的各项业务提供基座模型技术支持。多模态技术是通向AGI的重要方法和里程碑,期待和更多对多模态技术感兴趣的同学一起打造真正带来价值的模型算法技术; 2、深度探索多模态大模型的多阶段预训练、监督微调和RLHF等技术,打造业界第一梯队的多模态大模型,赶超GPT-4o、Gemini Pro等闭源模型的实际使用效果; 3、图片、语音、音频和视频多种模态信号的高效处理方式探索,提供对各类信号最精准的理解能力; 4、混合专家、蒸馏剪枝等兼顾模型性能和效果的技术探索。
1、负责通过基于大语言模型及多模态大模型的微调、prompts调优、指令构建及演化技术,将大模型的生成、理解、交互能力在公司核心业务场景应用落地,包括但不限于AIGC创意生成、视频处理、智能化特效、智能对话、代码生成、音视频传输、电商场景内容理解等; 2、负责LLM及多模态大模型的应用中台及相关技术模块搭建,包括但不限于Agents 、RAG、 function call、system prompts等,探索大模型应用前沿及新兴应用场景; 3、跟踪行业及大模型技术发展,结合业界前沿技术和业务需求,打造大模型应用的最佳实践; 4、了解业务,与公司各技术团队密切配合,能与产品、运营等角色高效沟通需求和目标,发挥自己的主观能动性,设计技术解决方案,培养自己的良好的业务sense和综合素质。