字节跳动大模型安全策略运营实习生-内容质量与数据服务平台
任职要求
1、2027届本科及以上学历在读,计算机、统计、数据科学或相关专业; 2、可提供至少3个月实习周期;具备机器学习基础知识,了解NLP或CV方向模型训练流程,理解准确率、召回率等模型评估指标; 3、熟练掌握S…
工作职责
ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:CQC(中国内容质量与数据服务平台)归属于抖音集团,负责今日头条、抖音、西瓜视频等产品内容和抖音集团商业内容的安全质量与体验,支持各产品的运营和增长,以及为产品线提供AI算法算力的基础支持服务。 1、基于安全策略需求,负责为算法训练提供高质量数据支持,覆盖数据挖掘、筛选、清洗及标注规范制定; 2、通过SQL及数据分析工具,深入挖掘线上数据,定位模型安全能力短板,输出可量化的优化方向; 3、与下游标注团队紧密协作,承担精标项目的需求对接、任务拆解与进度跟进,保障数据交付质量与效率; 4、参与安全策略效果评估,结合准确率、召回率等核心指标,持续跟踪数据投入对模型能力的提升效果。

1. 紧跟海内外相关法律法规动态,及LLM和智能体的风险态势,能构建风险矩阵,定义风险细则。 2. 构建全面、科学的护栏评测集,与算法深度合作,通过评测发现更多模型缺陷,牵引护栏能力的升级。同时整体为能力的运维与交付负责。 3. 深度支持业务,同算法一起为业务提供适配模型及应用的安全解决方案,推动安全策略的有效实施与迭代。
1、负责医疗大模型安全能力建设,围绕医疗安全、伦理合规、偏见与公平性等方向,定义医疗大模型的安全能力边界,并持续推动能力落地和效果提升; 2、基于对医疗应用场景和风险的理解,抽象医疗大模型安全能力,并拆解为模型训练和评测所需的能力体系、任务树与评估标准,与算法研发团队协作推进安全策略落地; 3、设计和制定医疗大模型安全相关的评测标准与评测方法,包括但不限于规则评测、Rubric评测、对抗式评测等,构建可量化、可迭代的安全评测体系; 4、负责医疗大模型安全评测数据的采集、构建与维护,探索高质量人工数据与合成数据相结合的数据生产方式,确保数据质量满足安全评测和模型对齐的要求; 5、对模型安全评测结果进行分析和总结,识别模型在安全、伦理和偏见等方面的风险点,与算法团队协作,将评测结论转化为可执行的训练和优化策略,推动模型安全能力持续提升; 6、跟进大模型安全、对齐和评测领域的前沿研究与行业实践,并结合医疗场景特点,持续优化医疗大模型安全能力建设方法论。
职位概述: 作为小红书Trust-and-Safety团队核心成员,负责制定生成式大模型相关安全防护和内容治理策略,保障生成式应用的安全合规性,优化AIGC内容在平台上的检测和标识。 主要职责: 1.负责生成式大模型安全防护产品策略的规划、设计和迭代,包括Safety Alignment、发prompt injection、反model jailbreak、风险生成内容过滤和实时检测机制。 2.负责设计多模态 AIGC 安全检测体系(文本/图像/视频),覆盖违规内容识别、伪造判定、真实度评估、深度伪造检测、模型生成技术追踪等方向。 3.持续跟踪和分析当前生成式AI技术的发展趋势,收集相关信息,并推动防御手段的更新和升级,以确保系统的安全性。 4.协同算法与研发团队,推动AIGC检测技术落地,优化防护效果和性能指标。 5.监控大模型安全态势,分析潜在风险,制定预防性和应急响应策略。 6.跨部门协调(如GA、安全运营、法务、数据),确保策略与业务目标对齐,并推动规模化应用。 7.跟踪行业法规和最佳实践,保障产品符合国内外安全与伦理标准。
1、负责生成式大模型安全防护产品策略的规划、设计和迭代,包括Safety Alignment、发prompt injection、反model jailbreak、风险生成内容过滤和实时检测机制。 2、负责设计多模态 AIGC 安全检测体系(文本/图像/视频),覆盖违规内容识别、伪造判定、真实度评估、深度伪造检测、模型生成技术追踪等方向。 3、持续跟踪和分析当前生成式AI技术的发展趋势,收集相关信息,并推动防御手段的更新和升级,以确保系统的安全性。 4、协同算法与研发团队,推动AIGC检测技术落地,优化防护效果和性能指标。 5、监控大模型安全态势,分析潜在风险,制定预防性和应急响应策略。 6、跨部门协调(如GA、安全运营、法务、数据),确保策略与业务目标对齐,并推动规模化应用。 7、跟踪行业法规和最佳实践,保障产品符合国内外安全与伦理标准。