logo of kuaishou

快手视频模型产品经理(可灵AI专项)

社招全职3-5年J0005地点:北京状态:招聘

任职要求


1、3年及以上互联网产品经理经验,有图像或视频生成方向的核心岗位经验优先;
2、对AIGC技术及行业有深刻理解,熟悉主流AI图像/视频产品的特点、优势及局限性;对AI创作充满热情,乐于探索技术的边界,渴望打造出改变内容创作方式的顶尖产品;
3、具备出色的沟…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责可灵视频模型的核心功能规划,通过深度洞察行业动态和用户需求,定义下一代视频生成模型的能力,独立完成模型产品方案的设计;
2、深度参与视频模型数据治理、美学标准制定、训练数据清洗、筛选与质量管控,支撑模型训练与效果优化;
3、与算法团队紧密协作,将用户场景和产品需求,转化为清晰、可量化的模型效果评估标准,建立端到端的模型评测与反馈闭环,指导模型效果优化;
4、负责视频生成核心功能的用户创作体验优化,并探索与定义前沿的AI原生交互模式。
包括英文材料
AIGC+
相关职位

logo of aliyun
实习阿里云研究型实习

岗位概述: 聚焦文生视频模型的推理与训练加速技术,探索、设计并实现全新的算法与系统级解决方案。解决当前文生视频模型面临的最大瓶颈:高昂的计算成本与漫长的生成时间。 岗位职责: 1、前沿算法研究与创新: (1)深入研究当前主流文生视频模型(如Wanx、CogVideo等)的架构,定位其在计算、内存及I/O上的核心瓶颈; (2)探索并设计全新的高效模型架构,将MoE、Sparse Attention等先进思想引入Diffusion Transformer,研究少步/单步生成技术; (3)针对视频生成中的时序建模,研发更轻量级但同样有效的时空注意力机制。 2、系统级优化与实现: (1)设计并实现高性能的自定义CUDA/Triton核函数,以支持不规则稀疏计算模式或新型算子; (2)利用量化、剪枝、蒸馏等模型压缩技术,在保持生成质量的同时,大幅缩减模型尺寸和计算量; (3)研究适用于高分辨率、长时序视频生成的计算与内存优化技术。 3、学术与技术影响力: (1)将研究成果发表在顶级AI会议,构建团队的行业影响力; (2)跟踪并分析业界最新的技术动态,确保我们的研究方向始终保持领先。

更新于 2025-11-26北京
logo of tencent
社招1年以上公共产品

1.负责研究大模型、世界模型、多模态模型、AI Agent 在游戏中的可落地形态,跟踪前沿技术演进,判断其在真实游戏场景下的成熟度与应用时机,并转化为可执行的产品判断; 2.负责定义 AI 原生玩法或 AI 辅助创作系统的体验目标、技术边界与验证路径,明确 AI 在体验中的角色、介入深度与能力兜底策略; 3.与算法、引擎团队共创原型,围绕世界一致性、因果关系、长程记忆、实时交互、生成稳定性等关键维度,系统评估模型在游戏场景下的实际表现,推动技术与玩法协同收敛; 4.负责将前沿技术向玩法、工具产品的转化过程沉淀为可复用的评估框架与方法论,形成对新模型、新能力的标准化判断路径; 5.协同算法、研发、引擎、设计等团队,完成技术调研、方案设计、原型验证、项目推进与效果评估; 6.持续关注大模型、世界模型、生成式 AI 及智能体等方向的发展趋势,结合玩法需求持续探索新的落地机会。

更新于 2026-07-16深圳
logo of alibaba
实习阿里巴巴日常实习

围绕Agentic视频生成方向,开展视频智能体架构设计、多镜头一致性控制和推理侧扩展相关研究,推动视频生成模型从“单点工具”向“自主系统”演进,并服务于广告营销、短剧创作等实际业务落地。 你将参与以下一个或多个方向的工作: 1. 视频Agent工作流构建:面向复杂剧情生成场景,研究视频Agent的核心组件,包括任务自主拆解、长短期记忆机制、工具调用及自我反思与修正。通过SFT/RLHF/DPO等后训练技术,提升模型在分镜规划与多维指令遵从上的能力,探索从模糊意图到高质量长视频生成的端到端智能体方案。 2. 可控生成与长视频能力:面向商业级视频交付需求,研究基于Agent上下文记忆的多镜头一致性控制算法,攻克复杂场景下角色IP、场景特征与运动规律的稳定性难题。通过后训练,重点突破长视频生成的时空稳定性与长效剧情逻辑,提升模型在长时序列下的生成质量。同时研究视频大模型在推理阶段的Test-time Scaling策略,突破模型在复杂提示词下的语义对齐上限。 3. 视频智能体评测与进化:构建完善的视频Agent量化评测体系,涵盖视觉一致性、意图命中率、任务完成度等核心维度,打通从数据采集、自动评测到模型在线迭代的闭环。结合广告、漫剧等具体业务场景,参与Agent系统的设计与优化,显著提升商业化视频生成的可用率与交付效率。

更新于 2026-04-13杭州
logo of bilibili
实习技术类

1.探索视频多模态大模型的前沿技术,负责数据建设、模型训练与评测框架搭建。 2.深入研究并实践视频多模态大模型的全套训练流程,包括pretraining、mid-training、SFT、RL、on-policy distillation等。 3.跟踪并复现主流的开源视频多模态模型,进行前沿论文的调研、复现与创新。 4.协助优化视频内容理解、dense video caption、视频生成/编辑中的用户意图理解等相关任务上的模型效果,持续提高算法的性能与效率。

更新于 2026-05-13上海