
同花顺AIGC算法实习生
任职要求
1. 硕士及以上学历,博士优先,数学/物理/自动化/计算机/电子工程/人工智能等相关专业 2. 熟练掌握计算机视觉领域的基础理论和方法,包括但不限于Transformer、VAE、GAN、Diffusion、VLM等,在一个或多个领域有深入研究:图像增强、虚拟试衣、ID一致性生成、多模态图像编辑等 3. 具备自有数据集构建经验,能够基于使用场景,构建多模态数据池,…
工作职责
岗位职责: 1. 参与同花顺图像编辑与生成能力构建和持续演进,完成关键技术点的能力提升 2. 参与产品研发,围绕用户高频使用场景,基于先验信息,完成图像的个性化编辑工作,构建产品和技术竞争力 3. 保持对学术界和业界技术趋势的持续跟踪,跟进图像编辑与生成的前沿技术与应用方向
1.跟踪和探索前沿3D生成式技术,重点研究基于扩散模型(Diffusion)的Text/Image-to-3D、可控3D资产生成及大型3D基础模型。 2.研究和应用相关技术,利用卫星图和3D矢量地图作为强几何/纹理约束,实现高清3D实景资产的自动化生成与业务落地。 3.具备一定的论文撰写能力和科研能力,熟悉NeRF/3DGS等重建技术者优先。
1. 负责平面/全景的影像 AIGC 前沿技术探索与研究,包括但不限于:平面/全景图像/视频生成与编辑、视频生成与一致性建模、图像生成与增强等。 2. 推动 AIGC 技术产品化落地:围绕真实场景数据与产品链路,将研究原型转化为可上线能力。 3. 将大模型能力与 AIGC 影像模型融合,增强产品功能与交互体验:探索并落地“大模型 + 影像生成/编辑”的组合方案。 岗位亮点和吸引点: 1. “帮助人们更好地记录和分享生活”,你的工作成果将进入无人机全景产品链路,帮助提升真实用户的拍摄、编辑与内容生产效率。 2. 全景是下一代“沉浸式内容”的底座,是从“平面影像”走向“空间影像”的关键形态。AIGC在全景域的能力成熟后,可显著提升内容生产效率与质量上限,长期应用空间广。 3. 全景能力与空间视频、VR/AR、机器人导航感知、数字孪生、地图与三维重建等方向强相关;在这里积累的“空间一致性”与“生成式系统”能力具备长期技术迁移价值。
1. 深度参与文生图大模型,图像编辑大模型的研发 2. 参与aigc生成方向的项目研发和落地,应用到小红书各业务线(创作发布、私信、商业化等)来解决实际业务问题; 3. 利用前沿机器学习算法,打造业内领先的多媒体内容理解和生成能力,包含但不限于图文大模型、LLM、VLLM等模型,负责对各业务场景下相关技术问题进行分析、算法设计、研发以及推动上线,提升业务效果。