字节跳动AIGC算法工程师-广告业务-筋斗云人才计划(北京/上海/深圳)
任职要求
1、获得博士学位,人工智能、计算机、数学相关专业优先; 2、优秀的代码能力、数据结构和基础算法功底,熟练Python(CV/NLP领域); 3、熟悉Diffusion、LLM等大模型相关算法和技术,熟悉大模型训练与调优,并且有实际应用的经验; 4、支持AIGC大模型在底层视觉、画质、压缩等多媒体方向的探索以及落地。 加分项: 1、有ICML、ICLR、NeurIPS、ACL、CVPR等学术会议发表过有影响力研究成果的优先; 2、有相关AIGC业务落地实习经历。
工作职责
团队介绍:广告业务原为商业产品与技术部门,为抖音集团的商业变现提供广告产品与技术,负责端到端大型广告系统建设,覆盖抖音、今日头条、西瓜视频、番茄小说、穿山甲等产品矩阵,践行"激发生意新可能"理念,致力于让营销更省心、更高效、更美好,推动商业的可持续增长,让不分体量、地域的企业及个体,都能通过数字化技术激发创造、驱动生意。连接广告主、用户及生态伙伴、成为开放共赢的全球最佳智能营销平台之一。在这里,你将投身建设面向未来的数字营销能力,接触到全球先进的商业产品架构、模型和算法,在互联网广告行业始终创新。 课题介绍: 1、核心技术架构: 1)下一代广告技术栈: 模型算法层:搭建基于强化学习的智能出价与流量预估系统,攻克深层转化场景下的数据稀疏、多源异构数据融合(延迟数据/埋点噪声/跨平台行为)等行业难题; 系统工程层:构建支持基于长序列特征的实时预估框架,研发支持动态创意组合的自动化投放引擎; AIGC融合层:建立文/图/视频多模态生成技术中台,实现从IP素材生成到智能投放的全链路闭环; 2)行业首创的AIGC解决方案: 正在搭建全球领先的"小说→漫剧"智能生产线,攻克三大技术堡垒: 多模态叙事引擎:研发支持角色一致性保持(Character-aware Diffusion)、分镜自动生成(Storyboard LLM)、动态运镜控制(Camera ControlNet)的复合型生成框架; 工业化工作流:构建支持分布式渲染、多版本AB测试、合规性审核的智能生产管线,实现日均千级素材产能; 投放增效系统:开发生成质量量化评估模型(QAGAN),建立素材生成-投放效果的反哺优化机制; 2、岗位挑战: 你将主导: 构建支持沿模型的混合推理框架,优化多卡并行下的生成效率; 设计跨模态对齐算法,提升文字指令到视觉元素的可控生成精度; 研发基于用户行为分析的智能素材变异系统,实现CTR提升30%+的个性化内容生成; 打造从内容生产到实时竞价的全自动化广告引擎; 3、我们期待这样的开拓者: 精通Diffusion Models技术栈,具有LoRA/ControlNet/T2I-Adapter等微调框架的实战调优经验; 熟悉多模态大模型(如VideoPoet、Sora等视频生成技术原理),具备跨模态表征学习研究背景; 拥有广告算法背景者优先,熟悉CVR预估、智能出价等核心模块与生成式AI的结合点; 出色的工程化能力,主导过至少一个完整AIGC项目的端到端落地(从模型训练到服务部署)。
团队介绍:广告业务原为商业产品与技术部门,为抖音集团的商业变现提供广告产品与技术,负责端到端大型广告系统建设,覆盖抖音、今日头条、西瓜视频、番茄小说、穿山甲等产品矩阵,践行"激发生意新可能"理念,致力于让营销更省心、更高效、更美好,推动商业的可持续增长,让不分体量、地域的企业及个体,都能通过数字化技术激发创造、驱动生意。连接广告主、用户及生态伙伴、成为开放共赢的全球最佳智能营销平台之一。在这里,你将投身建设面向未来的数字营销能力,接触到全球先进的商业产品架构、模型和算法,在互联网广告行业始终创新。 课题介绍: 1、核心技术架构: 1)下一代广告技术栈: 模型算法层:搭建基于强化学习的智能出价与流量预估系统,攻克深层转化场景下的数据稀疏、多源异构数据融合(延迟数据/埋点噪声/跨平台行为)等行业难题; 系统工程层:构建支持基于长序列特征的实时预估框架,研发支持动态创意组合的自动化投放引擎; AIGC融合层:建立文/图/视频多模态生成技术中台,实现从IP素材生成到智能投放的全链路闭环; 2)行业首创的AIGC解决方案: 正在搭建全球领先的"小说→漫剧"智能生产线,攻克三大技术堡垒: 多模态叙事引擎:研发支持角色一致性保持(Character-aware Diffusion)、分镜自动生成(Storyboard LLM)、动态运镜控制(Camera ControlNet)的复合型生成框架; 工业化工作流:构建支持分布式渲染、多版本AB测试、合规性审核的智能生产管线,实现日均千级素材产能; 投放增效系统:开发生成质量量化评估模型(QAGAN),建立素材生成-投放效果的反哺优化机制; 2、岗位挑战: 你将主导: 构建支持沿模型的混合推理框架,优化多卡并行下的生成效率; 设计跨模态对齐算法,提升文字指令到视觉元素的可控生成精度; 研发基于用户行为分析的智能素材变异系统,实现CTR提升30%+的个性化内容生成; 打造从内容生产到实时竞价的全自动化广告引擎; 3、我们期待这样的开拓者: 精通Diffusion Models技术栈,具有LoRA/ControlNet/T2I-Adapter等微调框架的实战调优经验; 熟悉多模态大模型(如VideoPoet、Sora等视频生成技术原理),具备跨模态表征学习研究背景; 拥有广告算法背景者优先,熟悉CVR预估、智能出价等核心模块与生成式AI的结合点; 出色的工程化能力,主导过至少一个完整AIGC项目的端到端落地(从模型训练到服务部署)。
团队介绍:广告业务原为商业产品与技术部门,为抖音集团的商业变现提供广告产品与技术,负责端到端大型广告系统建设,覆盖抖音、今日头条、西瓜视频、番茄小说、穿山甲等产品矩阵,践行"激发生意新可能"理念,致力于让营销更省心、更高效、更美好,推动商业的可持续增长,让不分体量、地域的企业及个体,都能通过数字化技术激发创造、驱动生意。连接广告主、用户及生态伙伴、成为开放共赢的全球最佳智能营销平台之一。在这里,你将投身建设面向未来的数字营销能力,接触到全球先进的商业产品架构、模型和算法,在互联网广告行业始终创新。 课题背景: 随着人工智能技术的快速发展,大模型技术在交易与广告场景中的应用日益广泛,已成为推动行业创新和效率提升的重要驱动力。大模型凭借其强大的学习能力和泛化性能,在多个领域展现出显著优势。例如,推荐大模型能够精准捕捉用户偏好,提升个性化推荐效果;AIGC(AI-Generated Content)技术可用于广告创意、商品图片和视频生成,大幅降低创作成本并提升内容质量;广告投放诊断系统和诊断助手帮助优化投放策略;智能客服、影片智能剪辑、智能导购、大模型审核、用户序列建模以及多模态广告和用户理解等应用,则通过自然语言处理、多模态数据融合等技术,提升用户体验和业务效率。 然而,交易与广告场景对大模型系统的要求极高,不仅需要模型具备出色的精度和泛化能力,还需在实时性、稳定性、可扩展性等方面满足严苛标准。特别是在大规模分布式训练、推理加速、异构硬件支持、多模态数据处理以及系统集成等方面,存在诸多技术难点。因此,针对交易与广告场景研发和优化大模型系统,不仅是人工智能技术发展的前沿方向,也是行业应用的迫切需求。本课题旨在通过系统和工程领域的深入研究,突破关键技术瓶颈,构建高效、稳定、可扩展的大模型解决方案,为交易与广告场景提供强有力的技术支撑。 课题挑战: 1、大规模分布式训练加速:大模型训练需处理海量数据和高复杂度计算,导致训练耗时长、资源需求大。如何优化分布式训练架构,提升数据并行、模型并行和流水线并行的效率,是首要技术难题。 2、推理加速和性能优化:交易与广告场景对实时性要求极高,如广告投放需毫秒级决策。如何在资源受限环境下通过模型压缩和推理引擎优化实现快速推理,是关键挑战。 3、异构硬件支持:大模型需适配多种硬件平台。如何实现高效部署和负载均衡,确保跨硬件精度一致性和高性能,是技术难点。 4、编译优化:编译优化是过程复杂,如何开发高效编译器,优化长尾/灵活模型或结构在不同Accelerator执行效率并减少延迟,是亟待解决的问题。 5、Agent工程:智能客服和导购等应用需构建自主决策的AI Agent。如何设计高效的Agent系统,支持复杂任务执行,是前沿挑战。 6、强化学习框架:强化学习在广告投放优化等场景中潜力巨大。如何构建高效框架,支持大规模环境训练和推理,是研究难点。 课题内容: 1、大规模分布式训练加速技术 1)研究数据并行、模型并行和混合并行算法,优化训练效率; 2)开发自适应负载均衡机制,减少资源浪费; 3)探索梯度压缩和通信优化技术,降低网络开销; 2、推理加速与性能优化方法 1)研究模型压缩技术(如量化、剪枝),减小模型体积; 2)开发高效推理引擎,支持批量推理和异步处理; 3)针对不同Accelerator的架构加速推理过程; 3、异构硬件支持与优化 1)设计通用部署框架,支持多硬件无缝集成; 2)开发硬件感知调度算法,优化任务分配; 3)研究跨硬件模型迁移技术,确保精度一致; 4、编译优化技术 1)深入优化模型编译器,优化长尾场景的计算开销; 2)研究图优化和算子融合技术,减少计算开销; 3)探索动态优化方法,提升运行时效率; 5、Agent工程与实现 1)设计模块化Agent架构,支持任务分解和决策; 2)开发多模态交互技术,提升用户体验; 3)研究Agent训练与评估方法,优化复杂场景性能; 6、强化学习框架构建 1)开发高效强化学习算法,支持多智能体协作; 2)针对交易与广告场景的训练场景优化训练速度,提升迭代效率; 3)探索强化学习在广告投放中的应用,提升决策效果。
团队介绍:国际商业化产品与技术团队支持字节跳动国际产品的广告产品与变现技术。我们负责end2end的大型广告系统建设,为客户提供商业推广方式与方案。我们的团队遍布北京、上海、美国、新加坡等地,在这里你将有机会开阔自己的国际化视野,接触到全球领先的商业产品架构、模型和算法,并有机会参与并推动互联网广告行业的创新和变革。 课题背景: 随着全球化业务的快速增长,广告场景面临千亿级数据训练、毫秒级实时响应、多模态内容理解与生成的综合挑战。传统广告模型(如CTR/CVR预估)在分布式训练效率、长序列用户行为建模、长尾泛化能力等方面逐渐面临瓶颈。与此同时,LLM技术为广告系统带来了革新机遇——从基于AIGC的广告素材生成、大规模超长序列建模、多模态视频内容理解,到隐私安全增强的联邦学习框架,以及通过大语言模型重构用户意图挖掘与定向策略等,均成为行业前沿探索方向。 课题挑战: 在广告业务场景中,探索LLM技术突破传统模型能力边界:一方面需重构广告召回与排序机制,通过长周期用户兴趣建模解决短行为序列的局限性,同时满足广告系统高实时响应要求,实现LLM增强的全域流量效率提升;另一方面需实现AIGC广告素材的规模化生产与精准控制,平衡品牌规范约束与创意多样性,适配全球化场景下的多语言与文化合规需求。此外,如何从非结构化行为数据中挖掘用户隐式意图,突破冷启动、泛化性等业务瓶颈,成为提升广告效果的关键技术创新方向。 另外广告生态特有的复杂约束对LLM技术提出更高要求:在海量站内站外信号的背景下,解决超大规模稀疏数据下的模型迭代效率问题;同时需构建隐私安全的LLM协同计算框架,在保障数据合规的前提下实现广告主专属数据与平台模型的深度协同。这些挑战要求技术方案兼具算法创新与系统工程能力,以应对广告场景中特有的实时性、规模化和合规性等多重挑战。
团队介绍:国际商业化产品与技术团队支持字节跳动国际产品的广告产品与变现技术。我们负责end2end的大型广告系统建设,为客户提供商业推广方式与方案。我们的团队遍布北京、上海、美国、新加坡等地,在这里你将有机会开阔自己的国际化视野,接触到全球领先的商业产品架构、模型和算法,并有机会参与并推动互联网广告行业的创新和变革。 课题背景: 随着全球化业务的快速增长,广告场景面临千亿级数据训练、毫秒级实时响应、多模态内容理解与生成的综合挑战。传统广告模型(如CTR/CVR预估)在分布式训练效率、长序列用户行为建模、长尾泛化能力等方面逐渐面临瓶颈。与此同时,LLM技术为广告系统带来了革新机遇——从基于AIGC的广告素材生成、大规模超长序列建模、多模态视频内容理解,到隐私安全增强的联邦学习框架,以及通过大语言模型重构用户意图挖掘与定向策略等,均成为行业前沿探索方向。 课题挑战: 在广告业务场景中,探索LLM技术突破传统模型能力边界:一方面需重构广告召回与排序机制,通过长周期用户兴趣建模解决短行为序列的局限性,同时满足广告系统高实时响应要求,实现LLM增强的全域流量效率提升;另一方面需实现AIGC广告素材的规模化生产与精准控制,平衡品牌规范约束与创意多样性,适配全球化场景下的多语言与文化合规需求。此外,如何从非结构化行为数据中挖掘用户隐式意图,突破冷启动、泛化性等业务瓶颈,成为提升广告效果的关键技术创新方向。 另外广告生态特有的复杂约束对LLM技术提出更高要求:在海量站内站外信号的背景下,解决超大规模稀疏数据下的模型迭代效率问题;同时需构建隐私安全的LLM协同计算框架,在保障数据合规的前提下实现广告主专属数据与平台模型的深度协同。这些挑战要求技术方案兼具算法创新与系统工程能力,以应对广告场景中特有的实时性、规模化和合规性等多重挑战。