荣耀AIGC图像视频生成算法工程师
任职要求
1、数学/物理/自动化/计算机/电子工程/人工智能等相关专业; 2、掌握计算机视觉原理知识,熟悉CNN、Transformer等架构,掌握图像视频生成基础算法者优先,包括但不限于DDPM、SDE、LDM等; 3、具备优秀的编码能力及扎实的数据结构/算法功底,掌握至少一种常用的深度学习框架(Pytorch/TensorFlow/Caffe),具备独立…
工作职责
1、负责AIGC图像视频生成前沿技术的研究,保持行业领先水平,持续突破技术上限; 2、负责AIGC图像视频生成算法的开发与性能提升; 3、提出和实现最前沿的算法,保持算法在工业界和学术界的领先。
1. 负责深度学习、生成式模型在图像与视频生成领域的研发与优化,包括文本生成图像(text-to-image)、文本生成视频(text-to-video)、图像/视频编辑等。 2. 研究并实现前沿的生成模型架构(如 Diffusion Models、GAN、Transformer、NeRF 等)以及多模态融合技术(文本、音频、视频、图像)。 3. 结合业务需求,设计和训练高质量的生成模型,提升生成结果的真实感、美学质量、语义一致性和可控性。 4. 建立数据采集与清洗流程,构建高质量的训练、微调和评估数据集(涵盖图像、视频、多模态)。 5. 设计、实现并维护模型推理服务,包括模型部署、性能优化、成本控制和稳定性保障。 6. 对生成模型的评测指标进行研究和完善,包括自动化评分、用户反馈收集、强化学习奖励函数等。 7. 跟进计算机视觉、生成式AI、多模态领域业界及学术新技术,并快速验证和落地。
岗位课题: 1.电商视频生成模型研发 2.多个视频应用模型研发 3.原生支持中文的图像生成模型研发 4.有语义泛化性的图像编辑模型研发 课题背景: AIGC 生成已成为广告创意制作的主流制作形式,基于AIGC 图像和视频生成模型提供了丰富的素材并持续提升创意制作的美观度和多样性。同时视频和图像生成模型也是各科技公司在AI 领域争夺的中心领域之一。 阿里妈妈在过去两年从业务需求出发,持续研发电商领域的多模态生成模型,推出了淘宝星辰视频生成模型、图生视频模型、短视频模型、服饰模特生图模型、图文海报制作等多个原创能力,并成功落地万相营造、万相台无界版、千牛、光合平台、生意管家等多个工具平台和展示、搜索、外投等多个投放场景的创意制作。 岗位职责: 你将有机会参与核心多模态大模型研究工作,深入到数据准备 | Caption | 训练系统搭建 | Encoder | Pretraining | Continuous training | SFT | Post training 等多模态生成的方方面面, 亲手解决大模型研发的问题,并最终交付电商场景领先的生成模型,以及有机会提前获得校招T-Star的正式Offer。
研究领域: 计算机视觉 项目简介: 随着图像/视频生成模型的快速发展,社交媒体圈传播着各种AIGC生成的图片/视频;随着AIGC图像/视频的现象级散播,其中涉及到侵权、风险传播以及负面的社会影响,随着监管的要求,平台发布的内容需要表明是否AIGC生成,因此AIGC检测能力必不可少。当前图像/视频AIGC技术依附于体系化数据集的构造,从数据驱动的角度进行检测能力的建设与升级,缺少对检测维度进行解耦,从不同的先验知识(例如光照、边界平整性、构图合理性、帧序列合理性等等)进行可解释性研究;考虑到当前MLLM模型在不同任务的驱动下,具备较强的理解能力,可以通过思维链式数据集构造或者思维链式交互方式,利用MLLM进行相关的泛化性、鲁棒性和可解释性研究
1. 负责图像/视频 AIGC 产品的整体规划与迭代,面向海外市场设计产品方案,驱动从概念到上线的全流程落地。 2. 深入研究海外图像/视频市场的用户分层需求与竞争格局——覆盖北美、东南亚、中东、拉美等不同区域市场的内容消费习惯、创作偏好和付费意愿,制定差异化的区域产品策略。 3. 持续跟踪 AIGC 领域的前沿技术进展,结合海外市场的内容趋势(如短视频、UGC 创作、社交分享等),将技术理解转化为面向全球用户的产品定义和功能方案。 4. 关注海外市场的数据隐私与合规要求(GDPR、CCPA、COPPA 等),确保产品设计和数据处理流程符合各区域的法规要求。 5. 与算法、工程、设计、运营团队紧密协作,推动产品功能的高效开发与全球化交付; 6. 配合海外增长团队,设计产品层面的增长机制和留存策略。