阿里云阿里云智能-AI Agent研发工程师/专家-杭州
任职要求
1. 计算机、人工智能、数学等相关专业本科及以上学历,3 年以上后端研发或 AI 工程落地经验,有生产环境 AI 应用调优经验。 2. 精通 Python、Go、Java 或 Node.js 至少一门语言,具备高并发、高可用分布式系统设计与问题排查能力。 3. 深入理解并熟练使用主流 Agent 框架(如 LangGraph、PydanticAI、LlamaIndex Workflows、CrewAI、AutoGen、smolagents 等),有源码级定制或重构经验优先。 4. 理解 Transformer 原理及主流大模型(Qwen、DeepSeek、Gemini、Claude、OpenAI 等),熟悉 ReAct、CoT、ToT、Plan-and-Solve 等推理范式。 5. 熟悉向量数据库…
工作职责
1. 负责 AI Agent 核心架构设计与工程落地,构建基于 Planning / Memory / Tool-use 的任务编排引擎,实现复杂任务的自动化规划与执行。 2. 基于 MCP(Model Context Protocol)构建可扩展工具体系,优化 Function Calling,打通 Agent 与企业系统的集成能力。 3. 设计并落地 Agentic RAG 与 GraphRAG,构建支持多跳推理与动态更新的长效记忆系统。 4. 设计推理策略与模型调优方案,包括混合路由策略、Prompt 优化及面向 Tool-use 场景的模型微调(SFT/DPO)。 5. 建设端到端评估与可观测体系,搭建 Eval Framework,对决策轨迹、工具调用准确率与自愈能力进行监控与优化。 6. 负责 AI Agent 在真实业务场景中的落地,进行技术预研、架构设计、业务抽象与核心模块研发,推动产品快速迭代。 7. 主导 AI 原生应用的端到端交付,打通大模型推理、Agent 编排与前端交互,完成从研发到上线的全链路建设。
● 岗位定位: 你将作为AI视频生产应用与Agent系统的核心建造者,负责打造这个时代最具创造力的“自主智能体”。我们正在用Agent重新定义视频生产的工作方式——不是让AI辅助人类操作,这个Agent将能够理解人类的创意意图,自主规划、调度并执行从创意到成片的整个视频创作流程。你将站在AI技术与视频创意的交汇点,设计并落地驱动这一切的Agent系统,让每个人都能指挥一个“AI制作团队”,让AI成为真正的"视频生产者"。 ● 核心职责 1. AI视频生产Agent架构设计 ● 主导设计面向视频全链路生产的Multi-Agent系统架构,拆解并定义不同角色Agent的能力边界与协作协议。 ● 构建支持复杂任务分解、动态规划、自主决策、异常恢复的Agent运行框架。 ● 设计Agent间的通信机制、状态管理与记忆体系,保障长链路生产任务的一致性、可追溯性与可干预性。 2. 多模态模型集成调优 ● 持续跟踪并将最新的图片生成、视频生成、音频生成、VL等多模态大模型集成进Agent生产链路,保持Agent能力的持续技术领先。 ● 对模型输出质量进行系统性调优,针对视频生产场景的语义一致性、运动合理性、视觉/音频质量、叙事逻辑性、指令遵循度、情绪传达力等关键指标进行专项优化。 ● 建立模型能力评测基准体系,定义质量基线与模型SLA,构建覆盖模型选型、版本对比、回归验证的数据化决策链路。 3. 任务规划与工作流编排 ● 设计基于LLM的动态任务规划引擎,支持自然语言输入→任务图生成→并行/串行执行→结果聚合的完整链路。 ● 在平台层统一工作流引擎之上,根据不同创作意图、内容类型、生产规格,在运行时动态构建差异化的视频生产工作流。 ● 攻关长链路任务的可靠性保障:任务断点续传、局部重试、人机协同介入点设计等核心工程难题,确保复杂任务在动态工作流下依然稳定可控。 4. 提示词工程与效果优化 ● 系统性构建面向视频生产各环节的Prompt工程体系,包括分层结构化、动态上下文、领域知识、多模态提示协同对齐等精细化设计。 ● 建立Prompt版本管理、A/B评测、自动优化机制,通过数据驱动持续提升Agent各节点输出质量。 ● 探索基于RLHF、DPO等技术的偏好对齐方法,让Agent的生产风格与用户意图高度契合,逼近"零修改直出"。 5. 视频生成流程自动化 ● 端到端打通从"创意"到"成片输出"的全自动化生产流水线,以最小化人工干预节点为终极目标。 ● 构建智能质检Agent,对生成视频进行自动化质量评估、问题定位与修复决策,形成自我纠错的生产闭环。 ● 设计支持批量生产、个性化定制、多风格并行的自动化调度体系,支撑规模化内容生产的工业级需求。
● 岗位定位: 你将作为AI视频生产应用与Agent系统的核心建造者,负责打造这个时代最具创造力的“自主智能体”。我们正在用Agent重新定义视频生产的工作方式——不是让AI辅助人类操作,这个Agent将能够理解人类的创意意图,自主规划、调度并执行从创意到成片的整个视频创作流程。你将站在AI技术与视频创意的交汇点,设计并落地驱动这一切的Agent系统,让每个人都能指挥一个“AI制作团队”,让AI成为真正的"视频生产者"。 ● 核心职责 1. AI视频生产Agent架构设计 ● 主导设计面向视频全链路生产的Multi-Agent系统架构,拆解并定义不同角色Agent的能力边界与协作协议。 ● 构建支持复杂任务分解、动态规划、自主决策、异常恢复的Agent运行框架。 ● 设计Agent间的通信机制、状态管理与记忆体系,保障长链路生产任务的一致性、可追溯性与可干预性。 2. 多模态模型集成调优 ● 持续跟踪并将最新的图片生成、视频生成、音频生成、VL等多模态大模型集成进Agent生产链路,保持Agent能力的持续技术领先。 ● 对模型输出质量进行系统性调优,针对视频生产场景的语义一致性、运动合理性、视觉/音频质量、叙事逻辑性、指令遵循度、情绪传达力等关键指标进行专项优化。 ● 建立模型能力评测基准体系,定义质量基线与模型SLA,构建覆盖模型选型、版本对比、回归验证的数据化决策链路。 3. 任务规划与工作流编排 ● 设计基于LLM的动态任务规划引擎,支持自然语言输入→任务图生成→并行/串行执行→结果聚合的完整链路。 ● 在平台层统一工作流引擎之上,根据不同创作意图、内容类型、生产规格,在运行时动态构建差异化的视频生产工作流。 ● 攻关长链路任务的可靠性保障:任务断点续传、局部重试、人机协同介入点设计等核心工程难题,确保复杂任务在动态工作流下依然稳定可控。 4. 提示词工程与效果优化 ● 系统性构建面向视频生产各环节的Prompt工程体系,包括分层结构化、动态上下文、领域知识、多模态提示协同对齐等精细化设计。 ● 建立Prompt版本管理、A/B评测、自动优化机制,通过数据驱动持续提升Agent各节点输出质量。 ● 探索基于RLHF、DPO等技术的偏好对齐方法,让Agent的生产风格与用户意图高度契合,逼近"零修改直出"。 5. 视频生成流程自动化 ● 端到端打通从"创意"到"成片输出"的全自动化生产流水线,以最小化人工干预节点为终极目标。 ● 构建智能质检Agent,对生成视频进行自动化质量评估、问题定位与修复决策,形成自我纠错的生产闭环。 ● 设计支持批量生产、个性化定制、多风格并行的自动化调度体系,支撑规模化内容生产的工业级需求。
1、负责企业级的AI Agent平台产品分析、架构设计、研发与持续迭代演进; 2、负责Agent技术研究应用及产品能力建设,包括不限于Multi-Agent、Workflow等,构建和完善多智能体系统的应用能力,确保系统的稳定性和扩展性。 3、负责Agent相关垂类应用落地,包括垂类Agent在商业化广告、客户服务、品牌营销、研究报告等方向的落地,提升智能体在复杂环境中的协作和决策能力。 4、能够持续学习、研究行业最佳实践,不断优化和提升大模型Agent的应用技术、支持业务场景下的Agent能力演进。