logo of kuaishou

快手生成式AI算法实习生【北京/深圳】

实习兼职D1915地点:北京状态:招聘

任职要求


1、硕士及以上学历,计算机、数学相关专业优先;
2、熟悉GAN 、扩散模型、VAE等生成模型原理,在图像生成和多模态等领域有深入研究,有图像视频风格化、图像降噪增强、超分等算法研发经验者优先;
3、在NIPS、ICMLCVPR、ICC…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责生成式AI方向技术研发,基于SD和GAN等研发行业领先的移动端视频实时风格化生成技术;
2、负责模型框架设计与训练,以及移动端实时模型的稳定性、可靠性、轻量化等方向的研究,包括但不限于图像和视频特效生成。
包括英文材料
学历+
算法+
ICML+
CVPR+
ICCV+
还有更多 •••
相关职位

logo of bytedance
实习A96776

团队介绍:广告业务原为商业产品与技术部门,为抖音集团的商业变现提供广告产品与技术,负责端到端大型广告系统建设,覆盖抖音、今日头条、西瓜视频、番茄小说、穿山甲等产品矩阵,践行"激发生意新可能"理念,致力于让营销更省心、更高效、更美好,推动商业的可持续增长,让不分体量、地域的企业及个体,都能通过数字化技术激发创造、驱动生意。连接广告主、用户及生态伙伴、成为开放共赢的全球最佳智能营销平台之一。在这里,你将投身建设面向未来的数字营销能力,接触到全球先进的商业产品架构、模型和算法,在互联网广告行业始终创新。 课题介绍: 1、核心技术架构: 1)下一代广告技术栈: 模型算法层:搭建基于强化学习的智能出价与流量预估系统,攻克深层转化场景下的数据稀疏、多源异构数据融合(延迟数据/埋点噪声/跨平台行为)等行业难题; 系统工程层:构建支持基于长序列特征的实时预估框架,研发支持动态创意组合的自动化投放引擎; AIGC融合层:建立文/图/视频多模态生成技术中台,实现从IP素材生成到智能投放的全链路闭环; 2)行业首创的AIGC解决方案: 正在搭建全球领先的"小说→漫剧"智能生产线,攻克三大技术堡垒: 多模态叙事引擎:研发支持角色一致性保持(Character-aware Diffusion)、分镜自动生成(Storyboard LLM)、动态运镜控制(Camera ControlNet)的复合型生成框架; 工业化工作流:构建支持分布式渲染、多版本AB测试、合规性审核的智能生产管线,实现日均千级素材产能; 投放增效系统:开发生成质量量化评估模型(QAGAN),建立素材生成-投放效果的反哺优化机制; 2、岗位挑战: 你将主导: 构建支持沿模型的混合推理框架,优化多卡并行下的生成效率; 设计跨模态对齐算法,提升文字指令到视觉元素的可控生成精度; 研发基于用户行为分析的智能素材变异系统,实现CTR提升30%+的个性化内容生成; 打造从内容生产到实时竞价的全自动化广告引擎; 3、我们期待这样的开拓者: 精通Diffusion Models技术栈,具有LoRA/ControlNet/T2I-Adapter等微调框架的实战调优经验; 熟悉多模态大模型(如VideoPoet、Sora等视频生成技术原理),具备跨模态表征学习研究背景; 拥有广告算法背景者优先,熟悉CVR预估、智能出价等核心模块与生成式AI的结合点; 出色的工程化能力,主导过至少一个完整AIGC项目的端到端落地(从模型训练到服务部署)。

更新于 2025-05-26北京
logo of bytedance
实习A239481

团队介绍:负责影像业务剪映、醒图等创作工具的增长、内容分发和商业化的算法,以及数据科学相关工作,致力于激发用户创作灵感、优化创作效率和提高所创作内容的价值,并完成增长与商业化变现。 课题介绍:剪映CapCut创作工具需要更自动化的扩大模版与素材的供给,降低创作过程的难度,本课题旨在通过AIGC根据当前热点,推荐,搜索等分发线索自动生成模版、素材、音乐,大规模补充模版与素材供给,为用户提供更多创作灵感,以及根据用户上传素材,AIGC辅助自动成片。 1、基于多模态大模型(LLM/视觉/音频)技术,研发自动化内容生成系统,通过分析热点、搜索趋势及用户行为数据,构建动态生成模型,实现视频模板、风格化素材、场景适配音乐的规模化生产,提升创作工具的内容供给多样性; 2、研究用户意图深度理解模型,通过用户上传的原始素材(图片、视频片段、文字描述)分析创作目标,构建端到端的自动成片Pipeline,实现镜头分割、转场特效生成、字幕匹配、音乐适配的全流程AI化; 3、设计跨模态对齐算法,解决图文/视频/音乐的多维度语义匹配问题。

更新于 2025-03-06北京
logo of bytedance
实习A71689

ByteIntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:字节跳动安全与风控-Flow部门,负责Flow业务中大模型和生成式AI应用如豆包、Cici、扣子等的安全保障工作。团队为业务面临的数据安全、用户隐私挑战、新兴大模型攻击方式等安全隐患提供创新的防御能力和解决方案,我们在北京、杭州、深圳、美国均设有安全研发中心,团队和业务正处于快速发展期,成长空间大,欢迎各位同学加入。 1、研究业界的算法和技术方案,探索大模型训练在安全领域应用的上限; 2、深入大模型技术栈,结合安全关键问题进行深度产品集成和落地,如代码分析、漏洞检测、自动化攻击研判、Oncall; 3、数据构建/合成/标注/清洗、推理模型/代码模型等后训练(SFT/RL)、框架开发、模型加速与蒸馏等; 4、与资深工程师合作,解决大数据量/可靠性/时延/成本等挑战,将研究成果落地产生价值; 5、与高校合作,共同发表顶级论文。

更新于 2024-12-02北京
logo of bytedance
实习A246982

ByteIntern:面向2026届毕业生(2025年9月-2026年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:字节跳动安全与风控-Flow部门,负责Flow业务中大模型和生成式AI应用如豆包、Cici、扣子等的安全保障工作。团队为业务面临的数据安全、用户隐私挑战、新兴大模型攻击方式等安全隐患提供创新的防御能力和解决方案,我们在北京、杭州、深圳、美国均设有安全研发中心,团队和业务正处于快速发展期,成长空间大,欢迎各位同学加入。 1、研究业界的算法和技术方案,探索大模型训练在安全领域应用的上限; 2、深入大模型技术栈,结合安全关键问题进行深度产品集成和落地,如代码分析、漏洞检测、自动化攻击研判、Oncall; 3、数据构建/合成/标注/清洗、推理模型/代码模型等后训练(SFT/RL)、框架开发、模型加速与蒸馏等; 4、与资深工程师合作,解决大数据量/可靠性/时延/成本等挑战,将研究成果落地产生价值; 5、与高校合作,共同发表顶级论文。

更新于 2024-12-02杭州