logo of sensetime

商汤智算云-IaaS开发工程师(计算/存储/网络)

社招全职1-5年后端开发地点:北京 | 上海状态:招聘

任职要求


1. 计算机、软件工程、通信或相关专业,本科及以上学历,1~5年相关开发经验;
2. 熟悉Linux系统内核机制,具备扎实的计算机基础(操作系统、网络、存储等);
3. 熟悉以下至少一个技术领域:
· 虚拟化或容器技术(KVM、DockerK8sOpenStack、VirtIO、CNI等);
· 分布式存储系统(CephHDFS、GlusterFS、NVMe-oF等);
· 网络编程与优化(TCP/IP、RDMA、DPDK、eBPF、SDN等);
4. 熟悉至少一…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


【我们提供】
1. 参与商汤自研智算云平台的底层核心研发,直接支撑大模型训练与AI基础设施建设;
2. 面对百亿参数级模型和超大规模集群的技术挑战,积累独特的工程经验;
3. 优秀的工程文化与导师机制,快速成长为系统架构师或平台负责人;
4. 行业内具竞争力的薪酬与晋升发展通道。

【岗位关键词】
IaaS / 云计算 / 分布式系统 / 存储 / 网络 / 容器 / Kubernetes / Ceph / RDMA / eBPF / OpenStack / 智算云 / AI基础设施

【岗位职责】
作为商汤科技智算云核心基础设施团队成员,您将参与构建和优化支撑大规模AI训练与推理的IaaS底层平台,打造高性能、高可靠的云计算基础能力。主要工作包括:
一、计算方向:
1. 负责虚拟化/容器化计算资源调度系统的设计与开发(KVM、Docker、Kubernetes、OpenStack等)。
2. 优化GPU/CPU混合集群的资源利用率、任务调度和性能隔离机制。
二、存储方向:
1. 参与高性能分布式存储系统(Ceph、HDFS、NVMe over Fabrics等)的研发与优化。
2. 负责对象存储、块存储的性能调优与稳定性保障。
三、网络方向:
1. 设计并开发高性能虚拟网络系统,支持大规模AI训练与推理流量场景。
2. 参与SDN、RDMA、DPDK、eBPF 等前沿网络技术的研发与落地。
持续推进系统性能优化与架构演进,支撑智算中心规模化运营。
包括英文材料
学历+
Linux+
内核+
Docker+
Kubernetes+
OpenStack+
Ceph+
HDFS+
网络编程+
TCP/IP+
还有更多 •••
相关职位

logo of sensetime
校招技术开发类

大装置智能云,支撑从云基础设施到大模型服务的完整产品体系。 欢迎加入测试开发团队,与我们一起打造下一代 AI 基础设施质量标准。 参与商汤大装置智能云核心产品的质量保障,包括: 1. 云平台方向(Cloud) · 云服务、容器平台(K8s)、网络/存储服务的功能与稳定性测试 · 自动化测试、接口测试、性能测试、系统级测试 2. 算力平台方向(Compute) · 多集群 GPU/NPU 算力池、调度平台的测试开发 · 压测、稳定性测试、异常场景验证 3. 大模型平台方向(AI Infra / MaaS) · 大模型推理、训练、评估平台的测试 · 模型性能测试、多模态模型验证、推理链路端到端自动化 4. 测试自动化,CI/CD 方向 · 测试框架、测试工具开发 · CI/CD 构建链路优化与集成 我们会根据你的能力与兴趣匹配到最合适的产品线。

更新于 2025-12-10北京|杭州|上海
logo of sensetime
社招3年以上Web前端开发

参与商汤大装置智能云的核心 Web 产品研发,包括: · 云控制台(算力/云服务/AI Infra) · AI 中台(大模型、数据、训练/推理平台) · 智能运营平台、官网等关键 B 端产品 我们会根据你的经验与意愿匹配具体方向。 岗位职责: 1. 负责大装置控制台、AI 中台、运营平台等 Web 应用的前端开发与架构优化。 2. 深度参与产品需求讨论,与产品、后端、设计团队紧密协作,推动功能迭代与用户体验提升。 3. 独立完成前端开发工作。 4. 优化系统性能、前端工程化体系和可观察性,提升整体开发效率与用户体验。 5. 参与前端组件、微前端架构及工程工具链的建设与持续优化。

更新于 2025-12-11北京|深圳
logo of jd
社招运维工程师岗

1. 负责建设和维护京东公有云平台,进行日常配置管理、线上变更、监控报警及故障响应等工作; 2. 负责公有云平台线上稳定性工作,确保达到业界领先的SLA水平; 3. 根据业务发展要求,做好容量规划与集群性能优化工作,在低成本、高性能、高弹性等方向上提供运营决策参考; 4. 参与平台运维体系建设工作,最大限度的实现运维工作自动化,建设符合云平台特点的自动化运维平台。

更新于 2025-06-18北京
logo of aliyun
社招3年以上云智能集团

1、深入理解阿里云AI智算集群的技术原理、架构和使用场景,根据客户需求,设计并实施高性能、可扩展的AI基础设施解决方案,核心聚焦于大模型的训练与推理场景,促进商业化合作达成。 2、具备良好的架构思维,能够从稳定性、高性能、易用性、可用性、可运维性等方面综合考虑,基于阿里云IaaS和PaaS的全栈AI基础设施,确保从算力、网络、存储的极致优化,持续为客户提供高质量AI基础设施服务。 3、面向国际市场,总结分析AI智算发展趋势/市场竟争格局,主动挖掘行业数据和客户商机,建立可复制的行业解决方案,与产研团队紧密配合,推动产品能力和营收持续增长。 4、具备需求拆解和整合的能力,成为对内外部AI智算技术的传播者,能够将复杂的AI基础设施技术转化为清晰的商业价值,成为客户和内部团队信赖的技术顾问。 5、作为领域专家参与客户Workshop、市场洞察等活动,并在行业峰会、技术沙龙等市场活动中进行阿里云AI智算技术传播和分享。

更新于 2025-12-08北京|杭州