
同花顺图像生成算法工程师
任职要求
岗位要求: 1. 硕士及以上学历,数学/物理/自动化/计算机/电子工程/人工智能等相关专业 2. 熟练掌握计算机视觉领域的基础理论和方法,包括但不限于Diffusion、VLM、Agent等,在一个或多个领域有深入研究:虚拟试衣、ID一致性生成、多模态图像编辑、图像编辑agent等 3…
工作职责
岗位职责: 1. 参与同花顺图像编辑与生成能力构建和持续演进,完成关键技术点的能力提升 2. 参与产品和模型研发,围绕用户高频使用场景,实现图像编辑工作(比如虚拟试衣、ID一致性生成等),构建产品和技术竞争力 3. 保持对学术界和业界技术趋势的持续跟踪,跟进图像编辑与生成的前沿技术与应用方向
1. 负责深度学习、生成式模型在图像与视频生成领域的研发与优化,包括文本生成图像(text-to-image)、文本生成视频(text-to-video)、图像/视频编辑等。 2. 研究并实现前沿的生成模型架构(如 Diffusion Models、GAN、Transformer、NeRF 等)以及多模态融合技术(文本、音频、视频、图像)。 3. 结合业务需求,设计和训练高质量的生成模型,提升生成结果的真实感、美学质量、语义一致性和可控性。 4. 建立数据采集与清洗流程,构建高质量的训练、微调和评估数据集(涵盖图像、视频、多模态)。 5. 设计、实现并维护模型推理服务,包括模型部署、性能优化、成本控制和稳定性保障。 6. 对生成模型的评测指标进行研究和完善,包括自动化评分、用户反馈收集、强化学习奖励函数等。 7. 跟进计算机视觉、生成式AI、多模态领域业界及学术新技术,并快速验证和落地。
- 负责内容结构化的需求分析、算法研发与上线迭代,融合多模态信息,构建类目、标签、合规及素材属性识别能力,提升素材管理与投放效率。 - 热点话题挖掘与趋势预测的分析建模与落地,基于语义表征、聚类、检索、时序建模等方法,提升内容供给与 UGC 创作效率。 - 负责图文/视频内容质量建模,完成特征分析、算法设计、实验评估与效果优化,构建高价值内容信号,服务推荐分发与商业投放。 - 负责 Anti-AI / Anti-GEO 识别的策略分析、模型研发与线上治理,保障搜索、推荐内容池真实性与健康度。
岗位课题: 1.电商视频生成模型研发 2.多个视频应用模型研发 3.原生支持中文的图像生成模型研发 4.有语义泛化性的图像编辑模型研发 课题背景: AIGC 生成已成为广告创意制作的主流制作形式,基于AIGC 图像和视频生成模型提供了丰富的素材并持续提升创意制作的美观度和多样性。同时视频和图像生成模型也是各科技公司在AI 领域争夺的中心领域之一。 阿里妈妈在过去两年从业务需求出发,持续研发电商领域的多模态生成模型,推出了淘宝星辰视频生成模型、图生视频模型、短视频模型、服饰模特生图模型、图文海报制作等多个原创能力,并成功落地万相营造、万相台无界版、千牛、光合平台、生意管家等多个工具平台和展示、搜索、外投等多个投放场景的创意制作。 岗位职责: 你将有机会参与核心多模态大模型研究工作,深入到数据准备 | Caption | 训练系统搭建 | Encoder | Pretraining | Continuous training | SFT | Post training 等多模态生成的方方面面, 亲手解决大模型研发的问题,并最终交付电商场景领先的生成模型,以及有机会提前获得校招T-Star的正式Offer。
ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:火山方舟是火山引擎推出的一站式大模型服务平台,是中国大模型市场产品和份额领跑者。平台提供模型推理、评测、精调等全流程服务。方舟搭载了豆包及业界主流大模型,提供丰富的插件生态和AI应用开发服务,并通过稳定可靠的安全互信方案、专业的算法技术服务,全方位保障企业级AI应用落地。 1、优化Seedream系列模型,为模型的通用能力提升相关技术负责,包含图像理解、图像生成、图像编辑等前沿技术; 2、推动技术在内容创作/特效/素材生成/辅助设计等领域的应用; 3、参与技术规划制定,把握图像生成技术最新发展趋势。