米哈游AI研发工程师(LLM Agent方向)-崩坏:因缘精灵
任职要求
1.熟悉大语言模型技术的原理和最新进展;
2.具备扎实的编程技能,具备LLM模型训…工作职责
1.将最先进的AI技术部署到游戏研发管线中,并转化为优化游戏生产和升级玩家体验的实际解决方案; 2.设计与开发基于AI Agent的研发工具链。包括但不限于代码审查、自动化测试和优化、策划配置生成等多项游戏制作环节; 3.与研发团队合作,定制引擎和工具流。协同策划、美术、程序团队重构工业化管线,建立AI驱动的敏捷研发新模式。
1、负责大模型/Agent应用核心链路的架构设计与系统研发,支撑大规模在线生产运行; 2、基于前沿大模型,设计Prompt组织、Agent编排、决策链路与评测机制,把模型能力转化为可度量的业务产能; 3、构建模型效果自动优化闭环与降本效率专项:错例归因、问题聚类、策略迭代、回归验证,推动系统自驱进化;推进平台在效果、成本、性能之间持续寻找更优解; 4、搭建面向AI决策的可观测与感知基础设施,让模型的判断过程对业务侧透明可信; 5、与策略、算法、模型训练、业务运营等多方深度协作,把复杂业务诉求翻译成可落地的技术方案。
背景介绍: 我们正在构建一个深度理解淘宝研发上下文的领域大模型,目标是打造一个具备“架构师级”洞察力的AI模型,从根本上提升研发效率与质量。如果你渴望在一个真实、复杂的场景中,将LLM的能力推向新的高度,并亲手塑造下一代软件研发的未来,我们期待你的加入! 1. 领域模型训练: 负责淘宝研发领域大模型的核心算法,主导持续预训练(Continual Pre-training)、指令微调(SFT)和对齐(RLHF/DPO)等训练流程; 2. 知识注入与推理: 设计并实践创新的数据方案,将代码、文档、配置等异构研发知识高效注入模型;通过多任务学习、FIM等范式,增强模型对软件工程的深度理解与复杂推理能力; 3. 能力评估与迭代: 建立科学的评测体系,精准评估模型在代码溯源、影响分析、故障排查等高阶任务上的能力;分析bad case,驱动数据和算法的闭环优化。

背景介绍: 我们正在构建一个深度理解淘宝研发上下文的领域大模型,目标是打造一个具备“架构师级”洞察力的AI模型,从根本上提升研发效率与质量。如果你渴望在一个真实、复杂的场景中,将LLM的能力推向新的高度,并亲手塑造下一代软件研发的未来,我们期待你的加入! 1. 领域模型训练: 负责淘宝研发领域大模型的核心算法,主导持续预训练(Continual Pre-training)、指令微调(SFT)和对齐(RLHF/DPO)等训练流程; 2. 知识注入与推理: 设计并实践创新的数据方案,将代码、文档、配置等异构研发知识高效注入模型;通过多任务学习、FIM等范式,增强模型对软件工程的深度理解与复杂推理能力; 3. 能力评估与迭代: 建立科学的评测体系,精准评估模型在代码溯源、影响分析、故障排查等高阶任务上的能力;分析bad case,驱动数据和算法的闭环优化。