logo of kuaishou

快手智能创作Agent算法工程师-【可灵AI】

实习兼职D13925地点:北京状态:招聘

任职要求


1、具备扎实的编程能力,熟悉数据结构算法,有ACM/ICPC、Kaggle等竞赛经历者优先;
2、对自然语言处理计算机视觉、多模态学习等方向有基础了解,熟悉大模型相关原理,有项目经验更佳;
3、熟悉多模态大模型(VLM)、大语言模型(LLM)相关的算法技术,在相关领域有课程项目、科研或开源实践经验,了解大模型数据构造方法、Post Training算法;
4、了解LLM架构,熟悉强化学习算法(GRPO、PPO、DPO、判别式及生成…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、参与智能创作Agent核心系统的研发与迭代,学习如何融合多模态理解、交互与生成能力,探索AI在内容创作中的应用场景;
2、协助搭建创作领域的多模态认知体系,结合行业知识库,理解镜头美学、剪辑节奏、叙事逻辑等要素,支持图片/视频/音乐生成模型的优化与应用;
3、参与大模型后训练相关探索(如SFT、RLHF 等),通过高质量数据合成、指令设计、偏好对齐等方法,提升Agent的长推理和复杂规划能力;
4、参与Agent相关核心模块的开发与实验,包括任务编排、工具调用、多Agent协作、长期记忆和个性化能力探索。
包括英文材料
数据结构+
算法+
Kaggle+
NLP+
OpenCV+
大模型+
还有更多 •••
相关职位

logo of kuaishou
社招J0011

1、负责智能创作 Agent与AI 内容生产模型的设计与优化。基于大语言模型与多模态模型,构建具备自主规划(Planning)、多步推理(Reasoning)、工具调用(Tool Use)、长短期记忆(Memory)、RAG 增强、多 Agent 协作及复杂 Workflow 编排能力的内容创作系统,覆盖剧本创作、分镜生成、角色设定、视频生成、内容编辑等复杂内容生成流程,持续提升生成效果、可控性与一致性; 2、负责 AIGC 图像与视频生成算法研发,包括 T2I、I2I、T2V、TI2V、视频编辑、条件控制生成等方向,推动生成模型在内容创作场景中的规模化落地; 3、探索 Agentic Framework 下的多模态内容创作系统,推动 LLM、VLM、视频生成模型与外部工具深度结合,构建理解、规划、生成、编辑一体化的智能创作 Agent; 4、与产品、工程团队协同,沉淀可复用的创作 Skill、Workflow 与评测体系,通过数据回流持续优化核心指标。

更新于 2026-06-01北京
logo of aliyun
社招3年以上云智能集团

岗位定位 我们正在把 Studio 从视频创作"工具"进化成"AI 创作平台"。这里不止一种创作方式,而是覆盖多种创作模式的完整创作体系。你将作为 Studio 创作体系的核心研发,负责把创作、编辑、智能生成、3D 可视化、多人协作等能力做成稳定、流畅、智能的产品,并能扎进不同创作模式持续做深、打磨。每一种创作模式都在走向 Agentic 化——每一次用户操作背后,都有 AI 在参与理解、生成与迭代。 核心职责 1. 创作模式能力建设 ● 负责 Studio 多种创作模式的核心能力研发与工程建设,扎进各创作模式持续做深、做好,打磨极致的用户创作体验,构建产品的核心竞争力。 ● 覆盖从故事板、自由画布到 Agent创作、智能剪辑等多种创作模式的建设,能根据方向重点灵活切入,把不同创作模式都做到好用、易用。 2. 让各创作模式更 Agentic ● 推动 AI Agent 深度融入每一种创作模式,让创作从"人操作工具"走向"人与 Agent 协同创作",把各创作模式整体带向更 Agentic 的形态。 ● 设计 Agent 参与创作的交互方式,让 AI 的理解、生成与调整过程对用户清晰可见、可控可干预,把不确定的生成过程做成顺畅、可信赖的创作体验。 3. 图形渲染、音视频与 3D 能力建设 ● 基于 Canvas / WebGL / WebGPU / OffscreenCanvas / WebAssembly / WebCodecs 等技术,建设高性能渲染与实时预览能力。 ● 负责音视频基础能力,包括播放、剪辑、转码、封装格式、字幕、音轨、流媒体协议、解码与处理链路。 ● 参与 3D 资产预览、空间编辑、镜头控制、实时渲染等方向的能力建设,探索 Mesh / 点云 / NeRF / 3D Gaussian Splatting 等新型 3D 表达在创作场景的落地。 4. 多端适配与多站点 ● 支持浏览器端、桌面端(Electron / Tauri)等多种运行环境,保障不同设备、分辨率、浏览器和网络条件下的一致体验。 ● 参与国际化、多语言等基础能力建设,支撑国内站 / 国际站 / 海外独立站等多站点的统一技术架构。 5. 性能与体验保障 ● 从用户体验出发,持续提升各终端的性能与创作流畅度,优化加载速度、交互响应、渲染稳定性与弱网体验,让复杂创作也能顺滑好用。 ● 建设产品质量与稳定性保障,覆盖监控、异常定位、自动化测试等能力,保障产品长期稳定迭代。

更新于 2026-07-13北京|杭州|广州
logo of quark
社招1年以上技术类-开发

1. 负责千问智能创作 AIGC 业务功能全栈开发,重点投入专业内容 Agent、AI图像、AI视频生成等方向; 2. 负责千问 AIGC Agent 方向的开发, 参与框架搭建、模型接入、Prompt 优化、质量评测等; 3. 负责全栈 AI Native 研发模式探索,基于 Coding Agent、Skill等能力建设,实现端到端 AI 开发; 4. 关注多模态模型的行业动态,与产品团队紧密合作,通过技术手段升级 Agent 能力,为用户创造全新AI Native 体验;

更新于 2026-07-20广州
logo of aliyun
社招3年以上云智能集团

岗位定位 我们正在把 Studio 从视频创作"工具"进化成"AI 创作平台"。这里不止一种创作方式,而是覆盖多种创作模式的完整创作体系。你将作为 Studio 创作体系的核心研发,负责把创作、编辑、智能生成、3D 可视化、多人协作等能力做成稳定、流畅、智能的产品,并能扎进不同创作模式持续做深、打磨。每一种创作模式都在走向 Agentic 化——每一次用户操作背后,都有 AI 在参与理解、生成与迭代。 核心职责 1. 创作模式能力建设 ● 负责 Studio 多种创作模式的核心能力研发与工程建设,扎进各创作模式持续做深、做好,打磨极致的用户创作体验,构建产品的核心竞争力。 ● 覆盖从故事板、自由画布到 Agent创作、智能剪辑等多种创作模式的建设,能根据方向重点灵活切入,把不同创作模式都做到好用、易用。 2. 让各创作模式更 Agentic ● 推动 AI Agent 深度融入每一种创作模式,让创作从"人操作工具"走向"人与 Agent 协同创作",把各创作模式整体带向更 Agentic 的形态。 ● 设计 Agent 参与创作的交互方式,让 AI 的理解、生成与调整过程对用户清晰可见、可控可干预,把不确定的生成过程做成顺畅、可信赖的创作体验。 3. 图形渲染、音视频与 3D 能力建设 ● 基于 Canvas / WebGL / WebGPU / OffscreenCanvas / WebAssembly / WebCodecs 等技术,建设高性能渲染与实时预览能力。 ● 负责音视频基础能力,包括播放、剪辑、转码、封装格式、字幕、音轨、流媒体协议、解码与处理链路。 ● 参与 3D 资产预览、空间编辑、镜头控制、实时渲染等方向的能力建设,探索 Mesh / 点云 / NeRF / 3D Gaussian Splatting 等新型 3D 表达在创作场景的落地。 4. 多端适配与多站点 ● 支持浏览器端、桌面端(Electron / Tauri)等多种运行环境,保障不同设备、分辨率、浏览器和网络条件下的一致体验。 ● 参与国际化、多语言等基础能力建设,支撑国内站 / 国际站 / 海外独立站等多站点的统一技术架构。 5. 性能与体验保障 ● 从用户体验出发,持续提升各终端的性能与创作流畅度,优化加载速度、交互响应、渲染稳定性与弱网体验,让复杂创作也能顺滑好用。 ● 建设产品质量与稳定性保障,覆盖监控、异常定位、自动化测试等能力,保障产品长期稳定迭代。

更新于 2026-07-21北京|杭州|广州