小红书智能创作算法工程师-文本/图像生成
任职要求
1.在大模型方向有一定经验,对Pre-train、SFT等技术有深入了解; 2.有良好的英文读写能力和扎实的数学基础,有快速学习新技术的能力; 3.有扎实的编程基础,熟悉Python/C++等编程语言,具有快速复现前沿论文的能力; 4.熟悉至少一个深度学习和大模型训练框架,包括PyTorch、TensorFlow、MXNet、Caffe、HuggingFace、DeepSpeed等; 5.…
工作职责
- 负责内容结构化的需求分析、算法研发与上线迭代,融合多模态信息,构建类目、标签、合规及素材属性识别能力,提升素材管理与投放效率。 - 热点话题挖掘与趋势预测的分析建模与落地,基于语义表征、聚类、检索、时序建模等方法,提升内容供给与 UGC 创作效率。 - 负责图文/视频内容质量建模,完成特征分析、算法设计、实验评估与效果优化,构建高价值内容信号,服务推荐分发与商业投放。 - 负责 Anti-AI / Anti-GEO 识别的策略分析、模型研发与线上治理,保障搜索、推荐内容池真实性与健康度。
1、参与智能创作Agent核心系统的研发与迭代,学习如何融合多模态理解、交互与生成能力,探索AI在内容创作中的应用场景; 2、协助搭建创作领域的多模态认知体系,结合行业知识库,理解镜头美学、剪辑节奏、叙事逻辑等要素,支持图片/视频/音乐生成模型的优化与应用; 3、参与大模型后训练相关探索(如SFT、RLHF 等),通过高质量数据合成、指令设计、偏好对齐等方法,提升Agent的长推理和复杂规划能力; 4、参与Agent相关核心模块的开发与实验,包括任务编排、工具调用、多Agent协作、长期记忆和个性化能力探索。
1、负责智能创作 Agent与AI 内容生产模型的设计与优化。基于大语言模型与多模态模型,构建具备自主规划(Planning)、多步推理(Reasoning)、工具调用(Tool Use)、长短期记忆(Memory)、RAG 增强、多 Agent 协作及复杂 Workflow 编排能力的内容创作系统,覆盖剧本创作、分镜生成、角色设定、视频生成、内容编辑等复杂内容生成流程,持续提升生成效果、可控性与一致性; 2、负责 AIGC 图像与视频生成算法研发,包括 T2I、I2I、T2V、TI2V、视频编辑、条件控制生成等方向,推动生成模型在内容创作场景中的规模化落地; 3、探索 Agentic Framework 下的多模态内容创作系统,推动 LLM、VLM、视频生成模型与外部工具深度结合,构建理解、规划、生成、编辑一体化的智能创作 Agent; 4、与产品、工程团队协同,沉淀可复用的创作 Skill、Workflow 与评测体系,通过数据回流持续优化核心指标。
日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会。 团队介绍:智能创作质量保障团队支持了公司内绝大多数产品&业务的音视频表达场景:通过火山引擎服务公司全球范围内几十条业务/产品线,上百家ToB客户;音视频&AI&特效&编辑&创作工具能力深度支持抖音、剪映、西瓜、头条、轻颜、Faceu、飞书等产品;领域覆盖中/长/短视频创作、直播、教育、硬件、新闻、社区、广告、工具、汽车、金融等行业领域。 1、深度参与视觉算法模块级模型的评测及评测体系建设,包括移动端、服务端算法的效果和性能基准测试,不限于产品分析、自动化测试工具开发等工作; 2、根据需求设计算法评测方案,业务场景数据覆盖,进行数据分析并执行评测,给出算法效果结论及优化建议; 3、挖掘新的测试&评测方法,对算法评测中与遇到的问题进行专项研究和改进。