小红书【REDstar】大模型训练/压缩/推理Infra研发工程师

校招全职大模型2025-09-24地点：北京 | 上海状态：招聘

扫码手机上打开

任职要求

1、本科及以上学历，计算机、人工智能等相关专业优先； 
2、熟悉Linux/Unix平台上的C++/Python/Rust编程，熟悉常用的数据结构和算法，有良好的编程习惯； 
3、具备大模型方向头部开源框架开发经验，或者具有大模型工程优化的前沿论文成果；
4、熟悉至少一种大模型训练或推理框架的原理和实现，具有修改源码或者深度使用的实践经验；
预训练框架：PyTorch、Megatron、DeepSp…

登录查看完整任职要求

微信扫码，1秒登录

工作职责

小红书中台AI Infra团队深耕大模型「数-训-压-推-评」技术闭环，具备专业的大模型训练加速、模型压缩、推理加速、部署提效等方向硬核技术积淀，基于RedAccel训练引擎、RedSlim压缩工具、RedServing推理部署引擎、DirectLLM大模型MaaS服务，支撑小红书社区、商业、交易、安全、数平、研效等多个核心业务实现AI技术高效落地！

大模型训练方向： 
1、参与设计实现支持RLHF/DPO等对齐技术的高效训练框架，优化强化学习阶段的Rollout、Reward Model集成、多阶段训练Pipeline；
2、研发支持多机多卡RL的分布式训练框架，开发TP/PP/ZeRO-3与RL流程的动态协同机制，解决RL算法在超长时序下的显存/通信瓶颈； 
3、基于自建的训推引擎，落地公司统一的大模型生产部署平台，为公司所有大模型算法同学提供端到端的一站式服务。

大模型压缩方向：
1、探索研发针对大语言模型、多模态大模型等场景的压缩技术，包括但不限于量化、蒸馏、剪枝、稀疏化等； 
2、参与/负责多个业务场景中的模型压缩技术实现，对模型进行轻量化压缩，提高训练/推理效率，支持业务降本增效； 
3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件，制定不同的模型压缩方案并在业务落地。

大模型推理方向： 
1、参与/负责研发面向LLM/MLLM等模型的稳定、易用、性能领先的AI推理框架；
2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术，支撑各业务方向持续降本增效； 
3、深度参与周边深度学习系统多个子方向的工作，包括但不限于模型管理、推理部署、日志/监控、工作流编排等。

高性能计算方向： 
1、参与/负责AI推理/训练框架的底层性能优化工作，包括但不限于高性能算子、通信库开发与优化等工作； 
2、参与/负责大模型计算引擎的研发工作，通过多种方式实现训推性能SOTA； 
3、参与/负责前沿AI编译加速等技术的探索和业务落地。

大模型服务方向：
1、参与/负责大模型MaaS系统的架构设计、系统研发、产品研发等工作； 
2、深入参与面向大模型场景的请求调度、异构资源调度、引擎优化等核心工作，实现万亿级并行推理系统；
3、为内部产品线提供解决方案，协助公司内用户解决大模型应用过程中业务在MaaS上的使用问题。

📮 投递简历 ✨AI模拟面试

难度：

包括英文材料

学历+

Linux+

Unix+

C+++

Python+

Rust+

数据结构+

算法+

编程规范+

还有更多 •••

登录查看完整学习资料

相关职位

【REDstar】机器学习算法工程师-中台算法

校招策略算法

1、负责小红书搜广推多场景召回与排序模型优化，提升时长、互动、留存等核心指标； 2、核心技术方向包括：LLM应用于推荐系统，基于搜广推全域信号打通的图神经网络预训练模型，深度进化学习应用于全系统参数自动搜索，多模态在召回/排序等模块的应用等技术方向；在小红书独特的双列社区产品形态下，探索最适合社区产品的种草拔草全链路建模范式； 3、业务落地场景包括：双列推荐/展示/搜索/电商广告的模型，用户/资源冷启动，重排和多资源混排场景等。

北京|上海

【REDstar】机器学习算法工程师-商业算法

校招策略算法

1、基于小红书海量的用户行为数据，建立并优化广告系统的算法和机制，优化面向行业广告主的算法策略，包括用户理解、行业深度优化、行业投放策略等； 2、对业界前沿技术保持敏感，结合业务特点，探索将前沿的算法技术应用于实际业务，实现技术落地。

北京|上海

【REDstar】机器学习算法工程师-社区算法

校招策略算法

1、负责小红书App社区（主站）的推荐、搜索、交易、增长、直播等业务场景的技术探索，能够从复杂的业务环境中抽象出清晰具体的技术问题，并将大模型、机器学习等技术有效应用于小红书App社区建设上，与各部门（包括并不限于产品，基础技术等）的同事一起深入交流合作，共同迭代和优化社区产品，提升亿级用户体验，Inspire Life； 2、构建小红书App社区（主站）的内容、用户之间的生产、关系、分发、消费机制，利用Query理解、多模态内容理解、相关性/召回/排序算法、深度学习、因果推断、迁移学习、跨域表征、多任务学习、图网络、运筹学、博弈机制等技术，持续建设图文&视频内容的大规模推荐/搜索/交易/知识生产等系统，通过策略和模型优化不断提升实现SOTA效果。

北京|上海

【REDstar】大模型压缩/推理/训练方向-AI平台

校招机器学习平台

模型压缩方向： 1、探索研发针对大语言模型、多模态大模型、StableDiffusion模型等模型的压缩技术，包括但不限于量化、蒸馏、剪枝、稀疏化等； 2、参与/负责多个业务场景中的模型压缩技术实现，对模型进行轻量化压缩，提高训练/推理效率，支持业务降本增效。推理框架方向： 1、参与/负责研发面向CV/NLP/多模态/大语言模型等类型模型的推理服务框架； 2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术，打造高效、易用、领先的AI推理框架。高性能计算方向： 1、参与/负责AI推理/训练框架的底层性能优化工作，包括但不限于高性能算子、通信库开发与优化等工作； 2、参与/负责大模型计算引擎的研发工作，通过多种方式实现训推性能SOTA； 3、参与/负责前沿AI编译加速等技术的探索和业务落地。模型训练方向： 1、负责调度公司所有模型训练与推理资源； 2、基于自建的训推引擎，构建公司统一的机器学习平台，为公司所有算法同学（稀疏 & 稠密，含 LLM）模型迭代提供端到端的一站式服务；包括数据生产，模型训练，模型上线，特征管理，模型测试，资源管控等一系列能力。

北京|上海