阿里云阿里云智能-高级测试开发工程师/测试开发专家-阿里云百炼
任职要求
1. 五年以上测试开发工作经验,有过大型 Java 项目质量保障经验。 2. 扎实的 Java/Python 代码基础,有测试工具及研发效能工具开发经验。 3. 熟悉互联网和移动互联网的自动化平台,如 selenium、ro…
工作职责
1. 负责阿里云百炼平台的质量保障工作,参与产品需求和技术方案评审,评估技术架构合理性和可测性。 2. 进行阿里云百炼平台的质量保障体系建设,包括功能测试、自动化测试、性能测试和稳定性测试等。 3. 配合开发团队进行问题排查和分析,解决线上用户问题,持续提升产品竞争力。
1. 负责大模型训练、推理、评测、部署等核心链路的质量保障体系建设。 2. 设计并实现自动化评测框架,支持多维度(如准确性、一致性、安全性、推理速度等)的模型能力评估。 3. 构建高质量、可扩展的评测数据集,制定科学、可量化的评测标准与指标体系。 4. 推动CI/CD流程在大模型工程中的落地,保障模型迭代的稳定性与可回溯性。 5. 主导Bad Case分析闭环机制,联动算法、工程与业务团队优化模型表现。

1. 负责大模型训练、推理、评测、部署等核心链路的质量保障体系建设。 2. 设计并实现自动化评测框架,支持多维度(如准确性、一致性、安全性、推理速度等)的模型能力评估。 3. 构建高质量、可扩展的评测数据集,制定科学、可量化的评测标准与指标体系。 4. 推动CI/CD流程在大模型工程中的落地,保障模型迭代的稳定性与可回溯性。 5. 主导Bad Case分析闭环机制,联动算法、工程与业务团队优化模型表现。
1. 负责智能 AI/Agent 类产品的质量保障体系建设,覆盖从需求评审、开发测试到上线监控的全生命周期; 2. 建立基于业务场景的质量评估模型,搭建自动化评测pipline,覆盖意图识别准确率、工具调用成功率、多轮对话连贯性及最终结果可用性; 3. 负责端侧业务交互链路的质量保障,确保多模态交互的流畅性、正确性等核心性能体验监控、优化推进; 4. 主导评测数据集构建与持续维护,建立 Badcase 分析与归因机制,推动算法/工程侧的质量改进闭环; 5. 规划并落地测试工具链、数据构造引擎及线上异常监控体系,将 AI 前沿技术(如 LLM-as-a-Judge、Agent 自动评测)转化为团队生产力; 6. 带领测试团队成长,提升团队对 AI 技术的敏感度与应用能力,沉淀 AI 质量保障的最佳实践。

1、有一定测试开发相关工作经验,需要有缺陷定位能力;有saas系统、电商系统、大厂经验的优先 2、熟悉软件开发、测试的流程和软件测试方法论,能根据项目需要编写良好的测试用例 3、可以使用Java/C++/Python/JavaScript等至少一种编程语言;能够阅读java代码、具备自动化测试工具或测试系统设计开发经验者优先 4、熟悉主流性能工具Jmeter等的使用,有性能测试经验优先 5、热爱软件测试及技术支持,具有较强的服务意识,逻辑能力强、思维活跃,能有效把控测试风险,有独立承担项目质量负责人经验者优先 6. 具备良好的语言能力,英语可作为工作语言