美团安全大模型技术专家
任职要求
1.计算机、人工智能或信息安全相关专业背景,硕士及以上学历,在安全领域(主机安全、网络安全、流量安全、风控等)有实际业务经验者优先。 2.熟悉模型训练、优化与部署流程,具备安全模型训练的实际项目经验。 3.熟悉AI Agent开发与智能交互设计,具备多智能体协作落地经验。 4.熟练掌握 Kafka、Spark、Flink 等流式处理技术,性能调优及大规模数据检索优化,具备 PB 级数据处理实战经验。 5.拥有网络安全领域知识基础,了解常见攻…
工作职责
1.负责安全大模型(LLM)和智能体的整体设计与开发,推动其在入侵检测(IDC)场景中的实际应用落地。 2.面向安全垂直领域,构建安全知识体系,并将高质量的领域知识转化为大模型的有效训练数据,提升其在业务场景中的理解与推理能力。 3.深入研究AI技术,探索大模型在安全领域的应用开发与性能优化,包括但不限于威胁检测、流量分析、异常行为识别和数据隐私保护等场景。 4.针对依赖安全专家经验的复杂任务(如告警运营、渗透测试、漏洞挖掘等),优化大模型能力,提升模型在真实攻防场景中的性能和鲁棒性,形成可复用的知识体系与最佳实践。 5.负责安全数据湖(Security Data Lake)的整体架构设计,与威胁检测场景紧密协作,将数据湖能力深度整合进威胁检测、自动化响应(SOAR)及威胁狩猎流程中。 6.与业界、学术界保持紧密合作,参与安全领域的技术交流与研究,推动大模型技术在安全领域的创新与发展。
1. 设计大模型推理(reasoning trace / CoT blob)的加密与隐私保护方案,覆盖密钥管理(per-user / per-session 密钥体系)、加密协议选型、防重放机制设计。 2. 防御机制拆解: 跟踪国内外主流模型的安全策略,通过实验分析其在内容过滤、逻辑保护方面的实现路径。 3. 安全围栏建设: 构建覆盖 Prompt Injection、Tool Abuse、模型滥用、越权访问、数据泄露等AI 风险的纵深防御能力 4. 反蒸馏技术落地: 协助落地基础的防爬取、模型输出干扰等风控方案,保护公司模型资产。 5. 跨团队协作: 与算法团队配合,将发现的安全漏洞转化为模型微调或强化学习的训练样本,并实验验证效果。 6. 系统化:建设企业级安全风险感知体系,持续发现业务及 AI 系统安全风险。推动AI安全能力平台化、产品化,为AI开发提供统一、安全、易用的基础能力。
1.主导集团大模型安全与对抗防御体系的构建:结合多模态、Agent、具身智能等前沿业务场景,负责大模型全链路(预训练数据防投毒/SFT对齐/RLHF/推理部署)的安全对抗演练、漏洞挖掘及红蓝对抗算法优化。 2.负责构建基于多模态与Agentic的自动化红队攻击体系:设计并研发基于强化学习、进化算法或多Agent协同的自动化越狱、提示词注入和对抗性扰动生成算法,实现对多模态模型的高并发、深层次安全边界压力测试。 3.负责大模型安全对齐与安全护栏算法的研发:研究并落地基于RLAIF、DPO、KTO等前沿对齐技术;设计并迭代高性能、低延迟的输入/输出内容安全过滤模型与多维风险评估机制,保障生成内容符合安全合规标准。 4.负责攻克大模型深层漏洞与新型威胁防御:针对间接提示词注入、数据投毒、偏好劫持及版权/隐私泄露等高阶安全威胁,研发对应的算法检测器与鲁棒性增强方案。 5.主导自动化对抗消融实验与防御价值验证闭环:设计高精度、轻量化的多维安全评测Benchmark与自动化对抗博弈平台,通过算子智能编排实现7*24H的“攻击自动生成-防御实时阻断-模型快速微调”的安全对抗迭代闭环。
团队介绍:国际化商业安全团队致力于在国际化用户、企业和产品之间建立安全可靠的连接。我们通过一系列完善的系统和能力,审核广告内容、预测政策违规行为,并执行广告审核通过或拒绝的措施。作为国际商业化团队的业务合作伙伴,我们提供的业务诚信解决方案不仅确保国际化业务始终是一个安全、积极、友好的用户环境,同时也推动业务增长。 课题介绍:随着数字内容的爆炸式增长,智能审核已成为互联网平台重要的技术能力,但面对日益复杂的审核场景和不断演进的对抗手段,传统审核技术正面临前所未有的挑战。当前智能审核领域存在规则动态性、内容复杂性、样本稀缺性、对抗升级和解释性缺失等诸多技术难题,特别是在涉及审核规则变更、长文本、长时序、多语言、少样本和AIGC生成对抗等问题时,现有的开源大模型表现仍有提升空间。 课题挑战:重点突破多模态推理、Context Engineering、理解与生成统一等核心技术,实现智能决策、自主规划、工具调用和智能修复等能力。 课题价值:打造领先审核系统,实现高质量的是否拒绝、为何拒绝、智能修复全流程能力,实现全机审,效果超人工。
团队介绍:国际化商业安全团队致力于在国际化用户、企业和产品之间建立安全可靠的连接。我们通过一系列完善的系统和能力,审核广告内容、预测政策违规行为,并执行广告审核通过或拒绝的措施。作为国际商业化团队的业务合作伙伴,我们提供的业务诚信解决方案不仅确保国际化业务始终是一个安全、积极、友好的用户环境,同时也推动业务增长。 课题介绍:随着数字内容的爆炸式增长,智能审核已成为互联网平台重要的技术能力,但面对日益复杂的审核场景和不断演进的对抗手段,传统审核技术正面临前所未有的挑战。当前智能审核领域存在规则动态性、内容复杂性、样本稀缺性、对抗升级和解释性缺失等诸多技术难题,特别是在涉及审核规则变更、长文本、长时序、多语言、少样本和AIGC生成对抗等问题时,现有的开源大模型表现仍有提升空间。 课题挑战:重点突破多模态推理、Context Engineering、理解与生成统一等核心技术,实现智能决策、自主规划、工具调用和智能修复等能力。 课题价值:打造领先审核系统,实现高质量的是否拒绝、为何拒绝、智能修复全流程能力,实现全机审,效果超人工。