logo of ctrip

携程云原生开发专家(容器方向)(MJ030846)

社招全职5年以上技术团队开发地点:上海状态:招聘

任职要求


1、本科及以上学历,有5年以上云原生相关经验的优先.
2、精通至少一种编程语言,如 GolangC++ 或 Java,具备扎实的编码能力。
3、熟悉云原生技术栈,具备良好的系统设计、架构能力及问题解决能…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、负责容器平台的设计、开发、性能优化,以及线上环境的运行分析和故障定位。
2、设计并实现大规模、高效、智能的容器调度系统,支持在线离线及多种工作负载混合部署。
3、提升调度服务质量,保障大规模调度场景的服务可用性,提升资源利用率。
4、利用数据分析等手段,挖掘不同场景下的潜在优化空间。
包括英文材料
学历+
Go+
C+++
还有更多 •••
相关职位

logo of xiaohongshu
社招3年以上基础后端

1、Kubernetes架构设计与开发: 深入理解Kubernetes原生架构的设计理念,参与并主导Kubernetes核心组件的开发和实现。 2、性能调优与优化: 通过监控工具(如Prometheus、Grafana)对Kubernetes集群进行全面性能分析,并优化关键节点、组件和流程,以提升整体系统的稳定性和响应速度。 3、集群部署与运维: 独立负责Kubernetes集群的稳定部署、监控与维护工作,确保集群在高负载环境下的可靠运行。 4、平台化能力建设: 研究并实施Kubernetes平台化的能力建设,提升平台的扩展性、可用性和可管理性。 5、跟踪云原生生态的最新发展趋势,研究并应用新技术以提升底座的稳定性、可扩展性、可维护性。 6、Agent Sandbox 平台设计与开发:基于云原生底座,设计并实现 Agent/Sandbox 全生命周期管理平台,支撑沙箱的规模化运行。

更新于 2026-07-18上海|北京|杭州
logo of xiaohongshu
社招3年以上后端开发

1.负责公司容器应用编排与调度平台的架构设计和核心功能开发,包括容器工作负载、资源管理、调度优化、弹性伸缩、GPU设备调度、任务调度等模块。 2.负责云原生工作负载编排能力的建设,包括大规模在线应用、分布式PD分离推理服务的分批发布、原地升级、批量灰度发布等能力;与集群联邦、调度器、公司内各个业务平台充分协同工作,确保在复杂场景下的工作负载编排调度策略具备高可用性和可扩展性。 3.设计和实现在线服务、离线应用、大数据任务的混部调度方案,优化集群资源的整体利用率,实现计算、存储和网络资源的高效调度。 4.针对不同业务场景,研究并改进 Kubernetes 调度算法,包括任务排队、优先级、抢占机制、节点选择等,提升集群的资源分配效率和稳定性。 5.跟踪云原生生态的最新发展趋势,研究并应用新技术以提升系统性能和调度灵活性。 6.支持系统的性能监控与故障诊断,参与系统优化和技术问题的快速解决,保障系统的高效稳定运行。

更新于 2026-07-19上海|北京|杭州
logo of aliyun
社招5年以上云智能集团

1、参与基础软件的设计、开发和维护,如 分布式应用服务、微服务注册配置中心、分布式事务、分布式任务调度、AI Agent Infra、AI 网关等产品的开发; 2、参与各个功能模块的设计和实现,构建高可靠性、高可用性、高可扩展性的体系结构,满足日趋复杂的业务需求; 3、参与超大规模的底层核心技术的设计和实现,为阿里云内部以及百万级云计算用户提供高性能高质量高弹性网络,计算及存储能力; 4、参与产品的开发和维护,完成从需求到设计、开发和上线等整个项目周期内的工作;

更新于 2026-06-24北京|杭州
logo of 4paradigm
社招实习类

职位介绍加入我们,你将会参与由第四范式自主研发的多模态大模型基础架构研发工作,和经验丰富的工程师以及科学家一起,参与到业界领先的多模态大模型训练任务中。主要工作内容包括但不限于: • 探索基于云原生的分布式多模态大模型训练任务调度方案,在GPU虚拟化,训练任务的拓扑优化方向找寻新的可能性 • 探索基于云原生的分布式多模态大模型训练的的网络和存储解决方案,优化整体集群的网络和存储效率

更新于 2023-05-30北京