蚂蚁金服蚂蚁集团-大模型算法专家-芝麻信用
任职要求
1. 硕士及以上学历,计算机科学或相关专业背景; 2. 具备大模型研发经验,在 Post-Training(如SFT、RL等)某一方向上有实操积累; 3. 具备较强的算法程能力,了解主流RL算法原理(如PPO、GRPO); 4. 熟悉数据与训练策略,了解主流训练和推理框架(如 Megatron、SGLang、vLLM等); 5. 具备极强…
工作职责
1. 负责芝麻信用事业部重点AI项目的算法与架构优化,保证对话准确率和长程任务完成率; 2. 探索包括SFT、RL在内的后训练算法研发与优化; 3. 构建具备深度思考和自主行动能力的基座模型,提升大模型在芝麻信用专项任务上的Agentic能力上限。
核心职责: 1. 多模态 RAG 架构设计面向文本、图像、表格、视频的统一检索增强生成框架,攻克跨模态知识索引与融合的核心挑战,让企业知识库中的每一种信息形态都能被精准理解和召回。 2. Agent 强化学习与自主规划探索基于 RL 的工具调用与任务规划能力,实现多轮多步骤复杂办公任务的自主执行,构建具备长期记忆与自我进化能力的下一代办公 Agent。 3. 大模型可信度与幻觉抑制研究幻觉检测与抑制技术,构建事实一致性评估体系与证据链追溯机制,确保企业级知识问答输出的每一个字都经得起验证。
1. 从flops efficiency角度,对大模型预训练过程进行分析与探索,包括不限于对scaling law的研究,数据的认知实验,MoE等模型架构设计,以及其他工程与算法结合的ml sys相关优化等。 2. 负责原生多模态大模型的构建与预训练,包括各模态分词器设计,合成数据策略,以及跨模态融合训练策略等,提升原生多模态模型在视觉/语音的理解与生成任务上的能力。 3. 进行大模型reasoning能力的相关研究,研究pre-train / test-time compute对于模型推理能力的影响,借助SFT / DPO / self-play等手段,提高模型在代码数学等推理任务上的表现。 4. 通过post-training激发模型在各下游任务上的能力,从而构建具有通用问题解决能力的agent。
1、负责跨境电商垂域多语言基础大模型的研发,持续建设和优化电商领域预训练、微调、后训练等全链路算法技术建设。 2、负责利用大模型提升电商领域的业务效果,例如搜索相关性、商品理解、多语言翻译和文案生成等方向。 3、前沿大模型技术突破,挖掘AI大模型技术在跨境电商场景的潜力,攻克大模型电商场景多语言翻译、大模型Agent等技术难题。