logo of quark

千问千问事业部-大模型内容安全算法高级专家-北京

社招全职5年以上技术类-算法地点:北京状态:招聘

任职要求


1、计算机、人工智能、数学等相关专业硕士及以上学历,5年以上算法研发经验。深入理解内容安全、风险建模或审核场景者优先;
2、深入理解大模型后训练全链路,具备SFTRLHF等后训练与对齐算法的实际落地经验,有从数据处理、奖励模型训练到对齐策略调优的完整项目经验。熟悉CoT、模型蒸馏、参数高效微调(PEFT)等优化方法;
3、具备LLM或VLM的实际研发经验,深入理解训练数据处理、训练与对齐。精通Python,熟练使用PyTorch等深度学习框架及DeepSpeed、Megatron等分布式训练工具;
4、有大…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责大模型内容安全防控体系的架构设计与落地,覆盖模型训练、服务上线到内容生成与传播的全链路风险管控。聚焦安全后训练技术路线,通过SFT、RLHF等对齐方法改进安全模型在内容安全场景下的效果,包括大规模数据合成、训练策略优化、自适应推理及可扩展知识注入等;
2、主导大模型安全后训练全链路研发与优化,包括:安全对齐训练数据的设计、合成与质量评估;奖励模型的构建与迭代;SFT/PPO/DPO/GRPO等后训练策略的设计与调优;安全对齐评测体系搭建。通过系统化后训练Pipeline,持续提升模型在风险内容识别、越狱攻击防御、有害意图判别、多轮对话安全等场景的对齐与泛化能力;
3、构建基于大模型能力的自动化风险挖掘与红队测试体系。利用LLM/VLM自动生成对抗样本、合成长尾风险场景,通过自我博弈与持续进化主动发现线上安全盲区与新型攻击模式,实现从“被动拦截”到“主动治理”的转变。搭建分钟/小时级闭环的自动迭代机制,覆盖新增风险的快速响应与模型热更新;
4、建立高危风险内容的快速识别与拦截机制,针对突发舆情或新型攻击,小时级完成策略迭代与模型热更新,确保业务零重大安全事故。保障大语言模型产品、多模态AI应用、搜索推荐等核心业务的内容安全与应用安全;
5、跟踪NeurIPS、ICML、ICLR、CVPR、ACL等顶会在大模型安全对齐、后训练、红队测试等方向的最新进展,持续迭代算法策略,保持技术领先。在团队中发挥技术领军作用,指导核心研发,推动跨团队协作与技术标准化。
包括英文材料
学历+
算法+
大模型+
SFT+
RLHF+
Python+
PyTorch+
还有更多 •••
相关职位

logo of bilibili
社招3年以上技术类

1.将风控治理需求转化为大模型识别方案,通过 Prompt Engineering、RAG、Workflow 持续调优; 2.探索 VLM 多模态大模型在视频内容安全场景的落地应用; 3.完成大模型指令微调、偏好对齐,提升风控场景识别效果; 4.设计开发安全 Agent,落地自动化风险研判、处置系统; 5.参与标注评测体系建设,构建风控专属高质量数据集; 6.研究对抗防御、幻觉检测、安全对齐技术,解决大模型风控痛点; 7.沉淀技术文档、方法论,保障大模型合规稳定运行。

更新于 2026-05-28上海
logo of aligenie
社招2年以上技术类-算法

1. 负责内容安全领域的大模型算法研发与落地,构建面向国际及国内多场景(如商品审核、社区内容、广告等)的智能识别与风险防控体系; 2. 设计并实现基于大模型的自动化审核系统,提升审核效率与准确率,支持高并发、低延迟的在线服务; 3. 负责商品治理领域的风险防控算法研发与落地,面向数十亿级商品库,构建覆盖假货、侵权、山寨、劣质、滥发等核心场景的智能识别体系,通过大模型驱动的内容理解、行为建模与知识推理技术,提升风险识别准确率与自动化处置能力,保障消费者购物体验与权利人平台权益,支撑电商生态健康可持续发展; 4. 探索大模型在内容理解、行为建模、团伙识别、跨语言语义分析等方向的应用,推动从传统规则/小模型向知识驱动AGI范式的演进; 5. 构建可解释、可迭代的知识生产闭环,支撑风险感知、策略生成与防控标准动态更新; 6. 参与大模型训练、微调、推理优化及部署全流程,提升模型在真实业务中的泛化能力与稳定性。

更新于 2026-04-07杭州
logo of alibaba
社招2年以上技术类-算法

1. 负责内容安全领域的大模型算法研发与落地,构建面向国际及国内多场景(如商品审核、社区内容、广告等)的智能识别与风险防控体系; 2. 设计并实现基于大模型的自动化审核系统,提升审核效率与准确率,支持高并发、低延迟的在线服务; 3. 负责商品治理领域的风险防控算法研发与落地,面向数十亿级商品库,构建覆盖假货、侵权、山寨、劣质、滥发等核心场景的智能识别体系,通过大模型驱动的内容理解、行为建模与知识推理技术,提升风险识别准确率与自动化处置能力,保障消费者购物体验与权利人平台权益,支撑电商生态健康可持续发展; 4. 探索大模型在内容理解、行为建模、团伙识别、跨语言语义分析等方向的应用,推动从传统规则/小模型向知识驱动AGI范式的演进; 5. 构建可解释、可迭代的知识生产闭环,支撑风险感知、策略生成与防控标准动态更新; 6. 参与大模型训练、微调、推理优化及部署全流程,提升模型在真实业务中的泛化能力与稳定性。

更新于 2026-07-20北京|杭州
logo of sohu
实习技术

1、探索多模态大模型在视频、图像、文本内容的理解能力,构建场景化模型,提升风险识别准召率; 2、研究UGC文本/图像拒绝理由的可解释性归因方法,推动人机协同审核应用落地; 3、构建大模型在风险防控等场景的垂类内容理解能力,优化模型对抗性及迭代效率; 4、开发视频、图文向量化表征技术,提升跨模态检索能力(如视频索引、图文相似性检索); 5、推动大模型在业务系统中的落地。

北京