logo of antgroup

蚂蚁金服AI基础设施工程

校招全职蚂蚁集团2027届应届生招聘地点:北京 | 上海 | 杭州状态:招聘♡ 收藏

工作描述


任职要求
基础条件
1.计算机、软件工程、电子信息、自动化等相关专业优先;
2.有高性能系统、分布式系统、训练/推理框架或开源项目经验者优先。
专业能力
1.扎实的软件工程与系统能力,熟悉 Linux 开发环境,掌握 Python、C++、Go、Java 等至少一门语言;
2.熟悉分布式系统基本原理,理解一致性、容错、扩展性、任务调度等核心机制;
3.理解大模型训练、后训练或 RL 基本流程,了解 rollout、采样、反馈数据链路等机制;
4.熟悉主流训练或推理框架,如 PyTorch、DeepSpeed、Megatron-LM、vLLM、sglang 等;
5.有 GPU 优化、高性能网络、分布式存储、资源管理或软硬件协同经验者优先;
6.有大规模训练集群、推理服务或高性能系统工程经验者优先;
7.对大数据引擎和分布式技术有浓厚兴趣,熟悉Spark/Flink/Hadoop大数据体系,或者有OLAP引擎、湖仓表格式、列式存储、SQL查询优化、分布式系统Ray、向量化引擎Velox等任一开源项目源码经验者优先。
能力特质
1.乐于挑战复杂系统性能…
登录查看完整工作描述
微信扫码,1秒登录

包括英文材料
分布式系统+
Linux+
Python+
C+++
Go+
Java+
大模型+
PyTorch+
vLLM+
SGLang+
大数据+
Spark+
还有更多 •••
相关职位

logo of mi
社招A229573

任职要求 1. 熟悉 Linux 系统、进程模型、文件系统、网络、权限控制和资源隔离机制。 2. 熟悉 Docker、containerd、Kubernetes 等容器化和云原生技术,有实际生产环境使

更新于 2026-05-11北京
logo of cambricon
校招

岗位职责: 深度开发智能加速卡Kubernetes插件,实现算力资源池化管理,优化拓扑感知调度以降低通信延迟; 研发容器运行时与调度器扩展功能,提升大规模集群任务编排效率与生命周期管理能力; 研发故障

上海|合肥
logo of minimax
社招3年以上

职位亮点 1.你将参与 AI 基础设施核心平台的建设,把复杂的 GPU 集群、节点与资产管理能力,转化为高效、易用的产品体验。 2.这里不只是常规的页面开发:你会面对大规模数据交互、可视化、网络拓扑、

更新于 2026-06-02北京|上海
logo of didi
社招3年以上技术

必须项: - 3 年以上后端开发经验,精通 Python(FastAPI/Flask)或 JAVA/Go,代码质量高、工程习惯好 - 熟悉 Web 安全基础,了解 OWASP Top 10、SQL

更新于 2026-06-22上海