
MiniMax系统研发工程师(网络方向)
社招全职基础架构地点:上海状态:招聘
工作描述
1、负责 AI 基础设施网络系统的研发工作,包括大规模 GPU 集群网络架构设计、RDMA/RoCE 网络管控面能力建设、网络资源管理与调度、网络监控与故障诊断自动化等。 2、参与或主导网络数据面相关系统研发与优化,提升大模型训练场景下的集合通信性能与网络吞吐,包括 NCCL 通信优化、网络转发路径、流控策略、拥塞控制等关键模块。 3、设计并实现网络管控面与数据面的解耦与协同机制,支持多集群、多租户场景下 DCN/DCI 网络的统一管理与高效运行。 4、针…
登录查看完整工作描述
微信扫码,1秒登录
包括英文材料
系统设计+
https://roadmap.sh/system-design
Everything you need to know about designing large scale systems.
https://www.youtube.com/watch?v=F2FmTdLtb_4
This complete system design tutorial covers scalability, reliability, data handling, and high-level architecture with clear explanations, real-world examples, and practical strategies.
大模型+
https://www.youtube.com/watch?v=xZDB1naRUlk
You will build projects with LLMs that will enable you to create dynamic interfaces, interact with vast amounts of text data, and even empower LLMs with the capability to browse the internet for research papers.
https://www.youtube.com/watch?v=zjkBMFhNj_g
NCCL+
https://developer.nvidia.com/nccl
The NVIDIA Collective Communication Library (NCCL) implements multi-GPU and multi-node communication primitives optimized for NVIDIA GPUs and networking.
学历+
还有更多 •••
相关职位
社招3年以上
1、计算机相关专业优先,3年以上Go大型项目核心开发经验; 2、精通Go及主流框架,熟悉多线程、高并发编程; 3、熟悉分布式系统设计,掌握微服务治理、分布式事务、限流降级等核心方案; 4、具备良好的沟
更新于 2026-09-11杭州

校招研发
1.本科及以上学历,自动化,控制科学与工程,机械电子工程,机器人等相关专业; 2.扎实的编程能力,熟悉Python/C++等主流编程语言,熟练掌握Linux、ROS2平台应用开发; 3.熟悉Isaac
更新于 2024-11-06北京

校招后端开发
加入AI基础设施团队,你将在导师指导下参与核心平台系统的学习和实践: 1. 参与平台建设: 协助开发与维护CMDB、工单系统、流程引擎等AI Infra关键平台。 2. 开发实践: 参与功能模块开发、
更新于 2026-07-06北京|上海