字节跳动AIGC算法工程师-广告业务-筋斗云人才计划(北京/上海/深圳)
任职要求
1、获得博士学位,人工智能、计算机、数学相关专业优先; 2、优秀的代码能力、数据结构和基础算法功底,熟练Python(CV/NLP领域); 3、熟悉Diffusion、LLM等大模型相关算法和技术,熟悉大模型训练与调优,并且有实际应…
工作职责
团队介绍:广告业务原为商业产品与技术部门,为抖音集团的商业变现提供广告产品与技术,负责端到端大型广告系统建设,覆盖抖音、今日头条、西瓜视频、番茄小说、穿山甲等产品矩阵,践行"激发生意新可能"理念,致力于让营销更省心、更高效、更美好,推动商业的可持续增长,让不分体量、地域的企业及个体,都能通过数字化技术激发创造、驱动生意。连接广告主、用户及生态伙伴、成为开放共赢的全球最佳智能营销平台之一。在这里,你将投身建设面向未来的数字营销能力,接触到全球先进的商业产品架构、模型和算法,在互联网广告行业始终创新。 课题介绍: 1、核心技术架构: 1)下一代广告技术栈: 模型算法层:搭建基于强化学习的智能出价与流量预估系统,攻克深层转化场景下的数据稀疏、多源异构数据融合(延迟数据/埋点噪声/跨平台行为)等行业难题; 系统工程层:构建支持基于长序列特征的实时预估框架,研发支持动态创意组合的自动化投放引擎; AIGC融合层:建立文/图/视频多模态生成技术中台,实现从IP素材生成到智能投放的全链路闭环; 2)行业首创的AIGC解决方案: 正在搭建全球领先的"小说→漫剧"智能生产线,攻克三大技术堡垒: 多模态叙事引擎:研发支持角色一致性保持(Character-aware Diffusion)、分镜自动生成(Storyboard LLM)、动态运镜控制(Camera ControlNet)的复合型生成框架; 工业化工作流:构建支持分布式渲染、多版本AB测试、合规性审核的智能生产管线,实现日均千级素材产能; 投放增效系统:开发生成质量量化评估模型(QAGAN),建立素材生成-投放效果的反哺优化机制; 2、岗位挑战: 你将主导: 构建支持沿模型的混合推理框架,优化多卡并行下的生成效率; 设计跨模态对齐算法,提升文字指令到视觉元素的可控生成精度; 研发基于用户行为分析的智能素材变异系统,实现CTR提升30%+的个性化内容生成; 打造从内容生产到实时竞价的全自动化广告引擎; 3、我们期待这样的开拓者: 精通Diffusion Models技术栈,具有LoRA/ControlNet/T2I-Adapter等微调框架的实战调优经验; 熟悉多模态大模型(如VideoPoet、Sora等视频生成技术原理),具备跨模态表征学习研究背景; 拥有广告算法背景者优先,熟悉CVR预估、智能出价等核心模块与生成式AI的结合点; 出色的工程化能力,主导过至少一个完整AIGC项目的端到端落地(从模型训练到服务部署)。
1、驾驭亿级规模核心系统:负责本地零售亿级商品库的顶层架构设计与演进,主导 SPU/CSPU 等基础模型建设,支撑高并发下的搜索、选品及多渠道分发,打造行业领先的商品数据底座。 2、引领前沿的 AI 大模型落地:深度参与AIGC 在商品全生命周期的变革,利用多模态大模型重塑智能发品、自动归类、内容生成及质量质检流程,推动业务从“人工运营”向"智能自治"跃迁。 3、构建数据与智能闭环:携手算法与产品团队,建立“数据 - 模型 - 业务”的高效反馈闭环。通过RAG 知识库、批量推理及自动化实验等前沿技术,持续优化商品数据的准确性与转化效率,赋能零售搜索与智能决策。 4、探索研发新范式与极致性能:在保障系统高可用与极致稳定性的同时,率先探索 Vibe Coding、AI Agent 等新范式在研发流中的落地,提升团队整体效能,解决海量数据下的复杂工程挑战。
团队介绍: 高德地图机器学习研发部是公司AI核心技术引擎,聚焦多模态大模型、视频生成与理解、图像编辑与生成等前沿领域。团队深耕人工智能技术落地,支撑亿级用户产品,同时长期投入前沿探索,在NeurIPS/ICLR/CVPR/ACL等顶会发表多篇论文,多项成果入选“最有影响力论文”榜单。我们拥有海量数据与算力资源,鼓励创新突破,诚邀你与顶尖算法专家并肩,共同定义AI的未来!如果你渴望挑战多模态与生成式AI的技术巅峰,在视频、图像、大模型的交叉领域实现突破,欢迎加入我们!团队的github页面是:https://github.com/AMAP-ML/ 我们提供 • 参与亿级用户产品的AI核心算法研发,见证技术直接赋能业务; • 与学术大牛和工业界专家共事,持续提升技术视野; • 顶配算力资源+开放创新氛围,支持前沿探索与顶会论文发表。 具体职责包括但不限于: 1. 视频生成:负责视频生成技术的前沿技术的研究,对AIGC的diffusion和auto-regressive技术有深入了解,在T2I/AIGCT2V/I2V上面有一定的研究,图文对齐,长视频生成等有一定的研究,做好视频生成在高德业务(广告,POI详情页等)中的进行落地。 2. 视频理解:能够使用和优化多模态大模型对用户上传的视频进行质量理解,标签,densecaption,视频summary等生成,作用到视频的搜索,广告,推荐等业务的落地。 3. 世界模型: 参与世界模型的构建,能够使用最新的视频生成技术,3D技术等构建符合人类物理规律的统一的世界模型,在高德的业务进行落地。 4. 紧跟技术前沿和技术沉淀,形成顶会论文和专利。
1、支撑企业级应用后台开发,使用 React、Vue 等前端框架开发web应用,实现交互需求及后端服务对接 2、以模块化的思想设计开发通用前端组件,并能够针对OTT,移动端进行针对性优化 3、在理解前端开发流程的基础上,结合前端实际建立或优化提升工作效率的工具 4、在理解产品业务的基础上,提升产品的用户体验,技术驱动业务的发展 5、关注前端前沿技术研究和AIGC的技术发展,通过新技术服务团队和业务