滴滴CPG-数据中心运维经理(国内和海外)(JR2026011200P)
任职要求
1. 本科及以上学历,暖通、电气、弱电相关专业。 2. 具有3年以上中大型数据中心(>1500柜)设计、交付或运维管理经验。有数据中心丰富稳定性管理经验者、海外数据中心项目经验者优先。 3. 熟悉数据中心架构、电气/暖通/监…
工作职责
1. 作为租赁数据中心的区域运营主管,代表客户参与机房基础设施运维管理和监督、应急响应、问题沟通等,对数据中心的运营和服务质量负责。 2. 确保数据中心电力、暖通、弱电、消防系统的可靠运行,及时识别运行风险,推动机房运营商进行整改和风险消除。 3. 负责数据中心异常情况的及时通报,故障的排查抢修跟进,现场应急保障。持续提升数据中心故障识别、定位和处理能力。 4. 参与基础设施运营商的巡检、维护、测试、演练、培训等运维活动,对运营商运维流程、计划和执行规范性进行监督。 5. 深度参与现场基础设施变更,审核变更方案,跟进变更进度,管控变更风险。 6. 能够独立阅读理解设计图纸,对照检查数据中心实际情况与图纸的符合性,识别系统架构层面问题风险。 7. 能够独立审查3P文件、应急演练预案的编制和执行质量,持续更新完善。 8. 参与数据中心选址准入的技术评估和标准迭代 9. 参与数据中心的建设方案论证、图纸评审、交付验收
base北京/杭州都可以~ 我们致力于构建高性能、高可用的企业级数据库产品与生态体系。作为数据库研发团队的核心成员,您将参与从数据库内核、中间件到管控平台的全栈技术攻关,深度影响数据库产品的稳定性、性能与用户体验,为海量数据场景提供坚实的数据基础设施。 1.数据库管控系统研发:参与数据库管控平台(DBaaS)的设计与开发,实现数据库实例的自动化部署、生命周期管理、监控告警、高可用切换、智能运维及资源调度等核心功能。 2.数据迁移与同步服务(DTS)研发:参与高可靠、高性能的数据传输服务开发,支持异构数据源间的实时同步、批量迁移、数据订阅等功能,保障数据流动的准确性与低延迟。
1、负责Kafka平台的架构设计与研发工作,推动技术的不断升级与优化,构建一流的数据基础设施,满足AI对数据Infra不断增长的需求; 2、负责Kafka内核开发工作,不断提升系统稳定性和集群性能; 3、负责Kafka集群的日常运维、监控、扩容和故障处理,支撑业务平稳运行。
base北京/杭州都可以~ - 负责滴滴AI平台的架构设计和工程研发,打造行业领先的聚焦AI开发迭代效率和资源利用效率的AI平台 - 探索业界前沿的机器学习研发(MLOPS)和大模型工程研发(LLMOps)相关技术,覆盖数据、实验、训练、评估、推理等各个方向 - 不断精进、研究和实现大模型方向的平台产品与技术
岗位职责 1、负责集团内部使用的运维平台产品的研发和运维,如容量管理、混沌工程、应急预案、运维作业、命令通道、可观测系统等运维平台产品和工具; 2、分析AI Agent时代下,这些传统产品面临的挑战和问题,如何优化升级为Agent时代更高效的新产品形态,大幅提升产品使用效率和体验; 3、参与实现从产品需求、前后端设计与编码实现,连调测试、发布的全流程自动化AI Coding 多Agent+人在线协作,大幅提升研发效率和工程师全栈能力; 3、对当前平台做整体梳理,消除可能导致故障的稳定性隐患,确保平台使用安全; 4、合理对产品功能进行定价,关注公司内部收入和成本核算,主动使用AI Coding优化代码效率,降低成本,设定并完成运维平台产品年度经营目标。