logo of xiaohongshu

小红书Hi Lab-【Ace顶尖实习生】探索大模型的高效训练方式和工程算法Codesign机制

实习兼职大模型地点:北京 | 上海 | 杭州状态:招聘

任职要求


1、不限年级,本科及以上在读,计算机/人工智能/软件工程等相关专业优先;
2、熟悉Linux/Unix平台上的C++编程,熟悉网络编程-多线程编程,有良好的编程习惯;
3、熟悉其中一种主流的深度学习训练或推理框架(TensorFlow / PyTorch / Onnx / TensorRT等)的原理和实现者优先;
4、有扎实的专业基础知识,熟悉常用的数据结构算法,对计算机系统结构-网络-操作系统等专业知识有深刻认知;
5、良好的沟通协作能力,责任心强,积极主动,能和团队一起探索新技术,推进技术进步。

工作职责


本课题的研究目标是研发大规模、高效易用的大模型训练框架,针对不同模型架构,探索多机多卡分布式训练的性能极限。

包括不限于:
1、高度稀疏化、长文本的模型训练策略优化;
2、大规模MoE模型的大规模RL训练性能优化;
3、基于模型的训练和推理瓶颈,工程算法Codesign探索下一代大模型网络结构设计。
包括英文材料
Linux+
Unix+
C+++
网络编程+
多线程+
编程规范+
深度学习+
TensorFlow+
PyTorch+
TensorRT+
数据结构+
算法+
ONNX+
相关职位

logo of xiaohongshu
实习大模型

本课题的研究目标是研发更高效的预训练scaling效率,通过数据策略、模型结构设计(Dense, MoE, Long Context等)、初始化&优化器策略、学习范式的创新,深度理解模型的学习机制和评估方法,能够更精准的预测模型行为,并持续提升模型预训练从算力&数据到智能的转化效率。

更新于 2025-08-22
logo of xiaohongshu
实习大模型

本课题的研究目标是: 1、研究如何充分用好文本、图片、视频等各个模态的有效信息,进行高效的多模态数据表征和联合建模,能够更加高效的从各个模态中学习有效信息; 2、探索多模数据如何才能更高效的学习,多模数据如何对文本智能能力有提升,探索理解和生成的联合建模如何进一步提高多模态模型的能力上限。

更新于 2025-08-22
logo of xiaohongshu
实习大模型

本课题的研究目标是研发面向复杂场景的可拓展大规模强化学习系统。 包括不限于: 1、超大规模Reward System构建; 2、面向复杂场景构建“策略与反馈一体化”的递归自我增强方法,解决“AI超越人类”时的可拓展监督问题; 3、面向长程任务探索人机合作博弈的强化学习机制,实现模型在超长程复杂任务上的需求明确、自我规划与执行校验能力;让AI从被动完成指令的工具转变为主动推动任务进展的的协作者,实现目标对齐; 4、强化学习进程中的大模型可解释性、可理解性。

更新于 2025-08-22
logo of xiaohongshu
实习大模型

本课题的研究目标是开发面向大模型的可扩展监督对齐方法,通过探索更高效的人类反馈收集与利用机制、自动化偏好学习和评估框架,以及对齐传递技术,实现在有限人类监督资源下对大规模AI系统进行有效对齐。 项目将建立产品与研究的协同设计机制,确保对齐技术能够直接响应实际产品需求,通过从产品应用场景中收集真实用户反馈来迭代优化对齐方法,形成研究与产品互促共进的闭环,提升模型在安全性、价值观一致性和指令遵循能力等方面的表现。

更新于 2025-08-22