logo of hello

哈啰超算平台研发工程师

社招全职软研类地点:北京 | 上海状态:招聘

工作描述


任职要求
扎实的 性能分析与实验设计 能力(如 PyTorch Profiler、Nsight Systems/Compute、perf、分布式 Trace 等至少深入一类)。
● 熟悉 GPU 训练 / 推理 范式;理解 数据并行、张量并行、流水线并行 及典型通信模式。
● Python 熟练;能阅读 C++ / CUDA 或愿意深入;Linux 网络 / 存储 基础扎实。
● 产品力与自驱性:能定义「团队看得懂、用得上」的性能看板与 playbook,并主动推动采纳。
加分项
● BEV / 时序多相机、点云或端到端 等 workload 上的实际调优案例。
● 熟悉 DeepSpeed / Megatron、vLLM / Triton 等之一在业务中的落地与取舍。
● 有 DataLoader / 多模态读路径 / DALI、TorchData 等高效数据管线实践,能量化 数据加载占比 与优化前后吞吐。

工作职责
● AI Co…
登录查看完整工作描述
微信扫码,1秒登录

包括英文材料
PyTorch+
Nsight+
Perf+
Python+
C+++
CUDA+
Linux+
还有更多 •••
相关职位

logo of hello
社招软研类

• 本科及以上学历,计算机、自动化、软件工程或相关专业。 • 熟悉至少一种编程语言:Python、Go、C++ 或 Java。 • 对 AI、分布式系统或云原生技术有兴趣,有相关课程或项目经验优先

更新于 2025-12-11北京|上海
logo of hello
社招算法

• 本科及以上学历,计算机、人工智能、软件工程、数学或相关专业。 • 熟练使用 Python,熟悉 PyTorch,理解模型训练流程、DataLoader 与分布式训练原理。 • 具备基本数据结构

更新于 2025-12-15上海
logo of deepseek
社招AI 核心系统研

【团队使命】 在 AI 时代,超算集群就是把电力转换为智能的引擎。它是通向 AGI 的坚实底座。 从万卡集群去往数十万卡的路上,丛生着系统复杂度的荆棘。我们的目标,是跑满所有计算资源,榨干每一份算力。

北京|杭州
logo of deepseek
实习全职

1. 本科及以上学历,计算机、电子、通信、自动化或相关专业优先。 2. 具备 Linux 服务器运维经验,熟悉集群环境下的系统管理、故障排查与性能分析。 3. 熟悉 GPU/AI 加速卡服务器、RDM

更新于 2026-05-22杭州