阿里巴巴淘天算法技术-AI Agent算法工程师(知识库方向)-杭州
任职要求
职位要求: 1、计算机、人工智能、模式识别等相关专业硕士及以上学历,3年以上相关工作经验。 2、具备以下一个或多个领域的深厚积累: 1)大模型(LLM): 熟悉主流大语言模型的原理,在Agent、偏好学习&强化学习、Agenitc RL、DeepResearch、Self-Evolving等方向有深入的实践经验。 2)多模态大模型(VLM): 熟悉主流多模态大模型的原理和应用,有丰富的图文匹配、跨模态生成、VQA、视觉内容理解等项目经验。 3)商品理解/知识图谱: 在电商领域,有深厚的商品属性体系构建、内容理解、知识图谱建设等相关经验,对电商商品数…
工作职责
商品基础算法团队是淘天集团核心的商品理解中台,负责对淘天全域(淘宝、天猫等)数百亿的商品进行深度、精准、多维度的内容理解。我们产出的商品认知能力(如属性、卖点、风格、品类、知识),是整个淘天搜索、推荐、广告、AIGC应用、智能导购、直播等所有核心业务的基石,直接决定了用户“逛”和“买”的体验,是连接“人”与“货”的智能引擎。 当前,我们正处在用新一代AI技术(大模型、多模态大模型)彻底重塑商品理解的历史机遇期。在这里,你将接触到海量的电商多模态数据,有机会定义下一代商品理解的技术范式,你的工作成果将通过集团各大业务场景,影响亿万用户的消费决策。 岗位职责: 1、参与商品 Wiki 知识库项目的研发与落地,综合运用 LLM、MLLM、Agent 等技术手段,系统性设计并持续迭代 Judge 引擎,驱动商品 Wiki 内容质量的规模化提升。 2、负责商品 Wiki 全链路质量管控,涵盖质量评估体系建设、错误样本挖掘与改写、人机协同审核流程设计等,通过精细化质量分层与闭环反馈机制,推动内容问题的系统性发现与治理。 3、运用 SFT、偏好学习(DPO/RLHF)、强化学习(RL)等后训练方法,持续提升 Judge 基础模型的判别能力;同时基于 Agentic RL 框架,增强 Judge Agent 在自主任务规划、多步推理及交叉验证等复杂场景下的决策能力。 4、深度跟踪 LLM / Agent 领域前沿学术与工程进展,结合业务场景开展技术可行性验证,推动前沿方法在实际生产环境中的高效落地与规模化应用。

1、设计与实现主动式创作 Agent 核心算法,服务于大规模、高质量、低运行成本的商业化产品; 2、构建可控 Agent 架构:包括Agent Runtime、Tool/Memory/Context 抽象、多 Agent 协作模式等; 3、与产品/工程高频密切合作,结合产品功能、模型能力边界与架构约束,实现 Agent 产品的整体架构方案设计; 4、持续探索、研究并引入新的框架和 Agent 技术范式。
● 参与高德 AI Agent 在通识搜索场景下的 RAG 系统建设与效果优化,围绕知识组织与预处理、检索策略框架、Context 注入质量控制、检索词改写、检索结果 rerank 等核心环节开展研发。 ● 建设以 LLM 推理为中心 的评估体系,从 Information Sufficiency、Reasoning Supportability、Noise Resistance、Output Faithfulness 等维度分析并优化通识搜索效果。 ● 结合离线评测与实验分析,定位检索、推理与生成链路中的关键问题,推动算法迭代和效果持续提升。
1、主导基于大模型的AI Agent全生命周期研发,包括通用型及垂直领域AI Agent的架构设计、模型训练与评测; 2、运用SFT、RL等Post-training训练方法,提升大模型在自主规划(Planning)、多步推理、RAG增强生成、工具调用、数据问答、文案生成等方面的能力; 3、跟踪LLM与Agent领域的国际前沿技术动态,推动技术创新在业务场景中的落地应用,重点突破复杂推理、数据洞察、AI搜索、文案创作、图像连续编辑等方向的应用创新; 4、持续优化Agent算法与系统架构,构建端到端的智能体评测体系,开发自动化评估工具与多维评价指标,提升Agent系统性能与效率,打造业内领先的AI Agent技术方案。
企业智能部intelligence Lab是小红书面向 AI-native 组织建设的创新团队,聚焦企业级 AI Agent、AI-native 管理产品、智能工作流与组织智能方向。我们希望通过大模型和 Agent 技术,重新定义公司内部的决策、管理和协同方式,让决策更有效、管理更简单、协同更高效,让工作回归创造。该岗位将重点参与 Research Lab / Agent 算法方向建设,围绕企业复杂场景中的 Agent 规划、推理、工具调用、上下文理解、结果评测与持续优化,打造可在真实业务中稳定运行的企业级 AI Agent 能力。 1、参与小红书内部 AI-native 产品的设计、原型验证和上线落地,围绕组织管理、业务分析、运营提效、知识协同、经营决策等场景,探索 AI 产品新形态。 2、参与 AI Agent 和 Agentic Workflow 的设计与开发,包括任务拆解、工具调用、上下文管理、记忆机制、结果校验、多轮交互和工作流编排等能力建设。 3、参与企业级 Context Layer 建设,结合小红书内部文档、业务数据、项目进展、组织关系、会议纪要、OKR 等信息,构建可被 AI 理解和调用的上下文体系。 4、参与大模型应用评测与 AI Trainer 相关工作,包括 Prompt 设计、模型输出评估、标注规范建设、Badcase 分析、Validation验证、效果评估、质量反馈闭环等。 5、深入小红书真实业务场景,与业务团队一起发现高价值 AI 应用机会,完成需求澄清、方案设计、快速原型、效果验证和产品化沉淀。 6、参与 AI Workflow FDE 项目交付,将业务中的重复性、复杂性、高认知负荷工作流转化为 AI 辅助流程,推动从单点提效走向规模化复用。 7、关注国内外 AI Agent、AI Product、LLM 应用、企业智能、工作流自动化等方向的前沿进展,并结合小红书业务场景形成产品判断和技术方案。