logo of autohome

汽车之家AI智能体评测高级产品经理

社招全职3年以上产品地点:北京状态:招聘

任职要求


任职要求:
1. 统招本科及以上学历,计算机、人工智能、NLP数据科学等相关专业优先
2. 3年以上用户产品经验,熟悉主流评测框架,有大模型/AI Agent产品完整评测实操经验及自动化评测落地经验
3. 有汽车行业项目背景优先,熟悉用户看车、选车、买车、…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1. 统筹汽车垂类AI对话App全链路智能体效果评测体系,搭建Agent标准化评测框架和自动化机评流水线及平台
2. 负责智能体全生命周期效果监控,驱动Agent核心能力持续优化,对智能体自动化评测覆盖率、人机打分一致率、业务问题闭环效果全权负责。
3. 面向看车/选车/买车/用车业务场景,负责评测数据集与行业基准建设,设计分层评测体系及场景化评测用例,定义多维度评测指标体系
4. 联动算法研发、数据标注及产品运营团队,打通「评测→根因分析→方案修复→复测验证」完整优化闭环,指引智能体迭代方向,提升用户全场景问答体验
5. 建立覆盖智能体需求开发、版本测试、线上灰度、线上数据回流全生命周期的质量管控标准,将评测准入规则嵌入产品迭代流程
包括英文材料
学历+
NLP+
数据科学+
还有更多 •••
相关职位

logo of tencent
社招5年以上腾讯云技术

1.负责腾讯自研龙虾WorkBuddy/腾讯AI IDE CodeBuddy产品质量保障及AI评测工作,推动产品质量体系,生成效果提升; 2.负责大语言模型(LLM)及Agent系统的评测体系设计与持续演进,覆盖模型能力评测、Agent任务评测、端到端产品功能评测等,构建Benchmark; 3.跟踪业界评测基准动态(如 SWE-bench、HumanEval、MMLU、AgentBench 等),结合业务场景进行适配与创新; 4.从无到有参与产品AI评测算法、评测标准和评测流程制定,构建评测集、评测执行器,推进评测刚才体系建设。

更新于 2026-06-03北京
logo of autohome
社招3年以上产品

1. 负责AI智能体App在用户看车、选车、买车、用车等场景下的产品落地,打造基于对话的下一代人机交互体验 2. 负责包括需求分析、功能定义、原型设计、版本规划在内的产品全生命周期迭代,并与相关团队紧密合作,确保产品从设计到上线的高效推进,并对核心指标负责 3. 通过用户调研、数据分析等手段,持续挖掘用户在看车/选车以及车主在车服务/车生活场景下的真实痛点,优化服务闭环与交互体验 4. 密切关注AI Agent、汽车出行、生活服务等领域的产品创新与竞品动态,为产品差异化提供策略建议 5. 深入理解Agent技术原理与AI大模型能力边界,将AI交互、情景感知、个性化推荐等智能特性转化为可落地的产品方案

更新于 2026-07-14北京
logo of meituan
实习核心本地商业-美

**想要完整闭环一个方向,有创业想法的同学来,希望你有很强的工程、商业化或是大模型相关算法能力三者之一,同时还想要持续快速迭代自己。 1. 深入美团内部本地生活相关业务场景,主动发现Agent技术可落地的高价值机会点 2. 建立场景评估框架,量化分析业务价值、技术可行性、落地成本 3. 输出场景验证方案,快速试错并迭代方向判断 4. 设计Agent产品的整体架构:任务理解→规划执行→工具调用→记忆管理→结果输出

更新于 2026-04-09北京
logo of autohome
社招技术

1、负责RAG + Agent系统的全链路集成与优化,包括检索增强、知识图谱融合、多步推理、工具调用、输出可控性等,持续提升业务场景下的端到端准确率、召回率、响应速度与鲁棒性 2、深度拆解复杂业务,将需求转化为可被Agent高效执行的结构化任务分解(规划、工具选择、多轮交互、自我反思/纠错等) 3、设计高可靠AI服务接口(REST/gRPC)、Prompt/Chain/Graph编排、后处理逻辑、错误恢复机制,确保AI能力稳定服务化

更新于 2026-07-14北京