logo of xiaohongshu

小红书大模型训练基础架构工程师

社招全职3-5年引擎地点:北京 | 上海状态:招聘

工作描述


任职要求
1. 有扎实的工程算法基础,精通数据结构和常用算法,熟练掌握各种编译、调试、性能分析工具。
2. 精通C/C++/CUDA,具备扎实的系统底层能力(内存、并发、网络)。
3. 有大规模分布式系统开发和优化经验;有大模型分布式训练经验者优先。
4. 精通MLIR/TVM/Triton/Torch Inductor/TileLang/Verbs/NCCL/NVSHMEM等分布式异构计算框架和相关工具链。
5. 精通Megatron/De…
登录查看完整工作描述
微信扫码,1秒登录

包括英文材料
算法+
数据结构+
C+
C+++
CUDA+
分布式系统+
大模型+
还有更多 •••
相关职位

logo of alibaba
社招3年以上技术-基础平台

1. 工程与算法基础:计算机相关专业背景,有极佳的工程实现能力,精通 C/C++ 与 Python;具备扎实的数据结构与算法功底,熟练掌握 GDB / Nsight 等调试与性能分析工具。 2. 大规

更新于 2026-08-15北京|杭州
logo of alibaba
社招3年以上

1. 工程与算法基础:计算机相关专业背景,有极佳的工程实现能力,精通 C/C++ 与 Python;具备扎实的数据结构与算法功底,熟练掌握 GDB / Nsight 等调试与性能分析工具。 2. 大规

更新于 2026-06-30北京
logo of aligenie
社招1年以上

1、1年及以上后端系统研发、调优经验,熟练掌握Go/Java/Python以及MySQL/MongoDB/PostgreSQL,并可基于此搭建稳定高效系统; 2、熟悉持续集成/持续部署(CI/CD)流

更新于 2026-04-06北京|杭州|广州
logo of alibaba
社招2年以上技术类-算法

1、扎实的工程能力,熟悉 Python,最好熟悉一种系统语言或高性能计算相关语言,例如 C++、CUDA、Rust 或 Go; 2、熟悉 PyTorch 生态,理解大模型训练的基本流程,包括 forw

更新于 2026-07-21杭州