logo of alibaba

阿里巴巴淘天算法技术-AI Agent算法工程师(知识库方向)-杭州

社招全职3年以上地点:杭州状态:招聘

任职要求


职位要求:
1、计算机、人工智能、模式识别等相关专业硕士及以上学历,3年以上相关工作经验。
2、具备以下一个或多个领域的深厚积累:
     1)大模型LLM): 熟悉主流大语言模型的原理,在Agent、偏好学习&强化学习、Agenitc RL、DeepResearch、Self-Evolving等方向有深入的实践经验。
     2)多模态大模型(VLM): 熟悉主流多模态大模型的原理和应用,有丰富的图文匹配、跨模态生成、VQA、视觉内容理解等项目经验。
     3)商品理解/知识图谱: 在电商领域,有深厚的商品属性体系构建、内容理解、知识图谱建设等相关经验,对电商商品数…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


商品基础算法团队是淘天集团核心的商品理解中台,负责对淘天全域(淘宝、天猫等)数百亿的商品进行深度、精准、多维度的内容理解。我们产出的商品认知能力(如属性、卖点、风格、品类、知识),是整个淘天搜索、推荐、广告、AIGC应用、智能导购、直播等所有核心业务的基石,直接决定了用户“逛”和“买”的体验,是连接“人”与“货”的智能引擎。
当前,我们正处在用新一代AI技术(大模型、多模态大模型)彻底重塑商品理解的历史机遇期。在这里,你将接触到海量的电商多模态数据,有机会定义下一代商品理解的技术范式,你的工作成果将通过集团各大业务场景,影响亿万用户的消费决策。

岗位职责:
1、参与商品 Wiki 知识库项目的研发与落地,综合运用 LLM、MLLM、Agent 等技术手段,系统性设计并持续迭代 Judge 引擎,驱动商品 Wiki 内容质量的规模化提升。
2、负责商品 Wiki 全链路质量管控,涵盖质量评估体系建设、错误样本挖掘与改写、人机协同审核流程设计等,通过精细化质量分层与闭环反馈机制,推动内容问题的系统性发现与治理。
3、运用 SFT、偏好学习(DPO/RLHF)、强化学习(RL)等后训练方法,持续提升 Judge 基础模型的判别能力;同时基于 Agentic RL 框架,增强 Judge Agent 在自主任务规划、多步推理及交叉验证等复杂场景下的决策能力。
4、深度跟踪 LLM / Agent 领域前沿学术与工程进展,结合业务场景开展技术可行性验证,推动前沿方法在实际生产环境中的高效落地与规模化应用。
包括英文材料
模式识别+
学历+
大模型+
AI agent+
强化学习+
算法+
Python+
C+++
SQL+
还有更多 •••
相关职位

logo of ztgame
社招软件研发类

1、设计与实现主动式创作 Agent 核心算法,服务于大规模、高质量、低运行成本的商业化产品; 2、构建可控 Agent 架构:包括Agent Runtime、Tool/Memory/Context 抽象、多 Agent 协作模式等; 3、与产品/工程高频密切合作,结合产品功能、模型能力边界与架构约束,实现 Agent 产品的整体架构方案设计; 4、持续探索、研究并引入新的框架和 Agent 技术范式。

更新于 2026-03-27上海
logo of alibaba
实习阿里巴巴研究型实

● 参与高德 AI Agent 在通识搜索场景下的 RAG 系统建设与效果优化,围绕知识组织与预处理、检索策略框架、Context 注入质量控制、检索词改写、检索结果 rerank 等核心环节开展研发。 ● 建设以 LLM 推理为中心 的评估体系,从 Information Sufficiency、Reasoning Supportability、Noise Resistance、Output Faithfulness 等维度分析并优化通识搜索效果。 ● 结合离线评测与实验分析,定位检索、推理与生成链路中的关键问题,推动算法迭代和效果持续提升。

更新于 2026-06-09北京
logo of alibaba
实习阿里巴巴日常实习

1、主导基于大模型的AI Agent全生命周期研发,包括通用型及垂直领域AI Agent的架构设计、模型训练与评测; 2、运用SFT、RL等Post-training训练方法,提升大模型在自主规划(Planning)、多步推理、RAG增强生成、工具调用、数据问答、文案生成等方面的能力; 3、跟踪LLM与Agent领域的国际前沿技术动态,推动技术创新在业务场景中的落地应用,重点突破复杂推理、数据洞察、AI搜索、文案创作、图像连续编辑等方向的应用创新; 4、持续优化Agent算法与系统架构,构建端到端的智能体评测体系,开发自动化评估工具与多维评价指标,提升Agent系统性能与效率,打造业内领先的AI Agent技术方案。

更新于 2026-03-26杭州
logo of xiaohongshu
社招1-3年大模型

企业智能部intelligence Lab是小红书面向 AI-native 组织建设的创新团队,聚焦企业级 AI Agent、AI-native 管理产品、智能工作流与组织智能方向。我们希望通过大模型和 Agent 技术,重新定义公司内部的决策、管理和协同方式,让决策更有效、管理更简单、协同更高效,让工作回归创造。该岗位将重点参与 Research Lab / Agent 算法方向建设,围绕企业复杂场景中的 Agent 规划、推理、工具调用、上下文理解、结果评测与持续优化,打造可在真实业务中稳定运行的企业级 AI Agent 能力。 1、参与小红书内部 AI-native 产品的设计、原型验证和上线落地,围绕组织管理、业务分析、运营提效、知识协同、经营决策等场景,探索 AI 产品新形态。 2、参与 AI Agent 和 Agentic Workflow 的设计与开发,包括任务拆解、工具调用、上下文管理、记忆机制、结果校验、多轮交互和工作流编排等能力建设。 3、参与企业级 Context Layer 建设,结合小红书内部文档、业务数据、项目进展、组织关系、会议纪要、OKR 等信息,构建可被 AI 理解和调用的上下文体系。 4、参与大模型应用评测与 AI Trainer 相关工作,包括 Prompt 设计、模型输出评估、标注规范建设、Badcase 分析、Validation验证、效果评估、质量反馈闭环等。 5、深入小红书真实业务场景,与业务团队一起发现高价值 AI 应用机会,完成需求澄清、方案设计、快速原型、效果验证和产品化沉淀。 6、参与 AI Workflow FDE 项目交付,将业务中的重复性、复杂性、高认知负荷工作流转化为 AI 辅助流程,推动从单点提效走向规模化复用。 7、关注国内外 AI Agent、AI Product、LLM 应用、企业智能、工作流自动化等方向的前沿进展,并结合小红书业务场景形成产品判断和技术方案。

更新于 2026-07-08北京|上海