希音大模型算法专家
任职要求
职责描述: 1. 计算机以及相关专业硕士及以上,有扎实的计算机知识和大模型算法功底。 2. 深入理解ChatGPT/LLaMA/Qwen/DeepSeek等LLM的算法原理,以及SFT/RLHF等训练技巧。 3. …
工作职责
1、负责跨境电商垂域多语言基础大模型的研发,持续建设和优化电商领域预训练、微调、后训练等全链路算法技术建设。 2、负责利用大模型提升电商领域的业务效果,例如搜索相关性、商品理解、多语言翻译和文案生成等方向。 3、前沿大模型技术突破,挖掘AI大模型技术在跨境电商场景的潜力,攻克大模型电商场景多语言翻译、大模型Agent等技术难题。
核心职责: 1. 多模态 RAG 架构设计面向文本、图像、表格、视频的统一检索增强生成框架,攻克跨模态知识索引与融合的核心挑战,让企业知识库中的每一种信息形态都能被精准理解和召回。 2. Agent 强化学习与自主规划探索基于 RL 的工具调用与任务规划能力,实现多轮多步骤复杂办公任务的自主执行,构建具备长期记忆与自我进化能力的下一代办公 Agent。 3. 大模型可信度与幻觉抑制研究幻觉检测与抑制技术,构建事实一致性评估体系与证据链追溯机制,确保企业级知识问答输出的每一个字都经得起验证。
1. 从flops efficiency角度,对大模型预训练过程进行分析与探索,包括不限于对scaling law的研究,数据的认知实验,MoE等模型架构设计,以及其他工程与算法结合的ml sys相关优化等。 2. 负责原生多模态大模型的构建与预训练,包括各模态分词器设计,合成数据策略,以及跨模态融合训练策略等,提升原生多模态模型在视觉/语音的理解与生成任务上的能力。 3. 进行大模型reasoning能力的相关研究,研究pre-train / test-time compute对于模型推理能力的影响,借助SFT / DPO / self-play等手段,提高模型在代码数学等推理任务上的表现。 4. 通过post-training激发模型在各下游任务上的能力,从而构建具有通用问题解决能力的agent。
1.负责京东信息安全大模型的应用研发工作,涵盖模型的持续预训练与优化、监督微调(SFT)以及强化学习等关键环节; 2.深入调研并积极探索大模型领域的前沿技术,包括先进的预训练方法、创新的 post-training 技术以及大模型强化学习技术; 3.参与大模型服务的部署实施,着力于模型量化处理和推理过程的加速优化,提升模型应用的性能和效率; 4.参与大模型在agent应用算法优化工作,提升agent任务执行效果;