蔚来校招-Infra 智能运营工程师
任职要求
5. 本科及以上学历、学士及以上学位,计算机类、通信类、软件开发相关专业优先; 6. 对人工智能技术有系统认知,关注Agent技术发展,热衷于探索技术在实际业务中的创新应用; 7. 拥有实习或校内项目经验,能从业…
工作职责
1. 参与AI智能体开发,结合业务场景拆解需求,输出可落地的智能解决方案原型; 2. 负责运维知识库的日常维护与迭代,优化知识管理流程,实现知识的自动化更新与过时内容筛选; 3. 深度参与AWS等公有云平台运维工作,执行监控、故障排查等任务,保障系统稳定性与高可用性; 4. 参与FinOps体系功能设计及开发,运用智能化手段优化计费逻辑,提升流程准确性与执行效率。
小红书中台AI Infra团队深耕大模型「数-训-压-推-评」技术闭环,具备专业的大模型训练加速、模型压缩、推理加速、部署提效等方向硬核技术积淀,基于RedAccel训练引擎、RedSlim压缩工具、RedServing推理部署引擎、DirectLLM大模型MaaS服务,支撑小红书社区、商业、交易、安全、数平、研效等多个核心业务实现AI技术高效落地! 大模型训练方向: 1、参与设计实现支持RLHF/DPO等对齐技术的高效训练框架,优化强化学习阶段的Rollout、Reward Model集成、多阶段训练Pipeline; 2、研发支持多机多卡RL的分布式训练框架,开发TP/PP/ZeRO-3与RL流程的动态协同机制,解决RL算法在超长时序下的显存/通信瓶颈; 3、基于自建的训推引擎,落地公司统一的大模型生产部署平台,为公司所有大模型算法同学提供端到端的一站式服务。 大模型压缩方向: 1、探索研发针对大语言模型、多模态大模型等场景的压缩技术,包括但不限于量化、蒸馏、剪枝、稀疏化等; 2、参与/负责多个业务场景中的模型压缩技术实现,对模型进行轻量化压缩,提高训练/推理效率,支持业务降本增效; 3、参与/负责针对英伟达GPU、华为昇腾NPU等不同的计算硬件,制定不同的模型压缩方案并在业务落地。 大模型推理方向: 1、参与/负责研发面向LLM/MLLM等模型的稳定、易用、性能领先的AI推理框架; 2、通过并行计算优化、分布式架构优化、异构调度等多种框架技术,支撑各业务方向持续降本增效; 3、深度参与周边深度学习系统多个子方向的工作,包括但不限于模型管理、推理部署、日志/监控、工作流编排等。 高性能计算方向: 1、参与/负责AI推理/训练框架的底层性能优化工作,包括但不限于高性能算子、通信库开发与优化等工作; 2、参与/负责大模型计算引擎的研发工作,通过多种方式实现训推性能SOTA; 3、参与/负责前沿AI编译加速等技术的探索和业务落地。 大模型服务方向: 1、参与/负责大模型MaaS系统的架构设计、系统研发、产品研发等工作; 2、深入参与面向大模型场景的请求调度、异构资源调度、引擎优化等核心工作,实现万亿级并行推理系统; 3、为内部产品线提供解决方案,协助公司内用户解决大模型应用过程中业务在MaaS上的使用问题。
1. 负责公司AI平台架构设计和迭代,包括训练、推理、数据处理、存储等; 2. 结合AI工作流(如:数据生产、训练、仿真等),设计方案,提升研发效率; 3. 跟踪AI infra行业技术发展,保证技术领先性。

base地 北京/上海/广州/深圳 关于感知方向 感知是无人驾驶中非常复杂和有趣的部分之一,你构建的是一个人工智能集大成的系统,不是一项按部就班就能完成的工作!感知软件工程师负责无人驾驶感知系统的设计和实现,应对无人驾驶中各种最有挑战的问题: 设计高效可靠的深度学习模型,在几十毫秒内精确检测和跟踪车周围200米之内所有的障碍物(人,车,非机动车辆,交通锥等),并对场景进行理解 如何设计一般性的模型和算法去处理各式各样的长尾情况,如路面上的垃圾袋,洒水车的水花,前车掉下来的挡板 如何保证感知模型和算法在极端的环境里的准确性和可靠性,如大雨,大雪,雾霾,风沙等 把模型优化到极致,让十几个到几十个模型在车上有限的计算资源上欢快的运行 如何搭建一个高效可靠的计算框架,支撑一个周期内接收几十个传感器的输入,做各种同步融合,并进行几十个深度学习模型的推理。 关于感知Infra方向 感知infra构建感知系统的基石,包括但不限于: 搭建高效可靠的计算框架; 实现模型的inference engine并对模型进行优化; 建立精确稳定高效的评估系统;搭建高效好用的训练框架等。