
同程旅行云原生存储高级专家
任职要求
1. 扎实的分布式系统基础,对一致性、可用性、容错、CAP/BASE 有深入理解 2. 深入理解至少一种分布式存储系统的内部实现原理,并具备生产级实战经验,包括但不限于: 对象存储:S3、Ceph RGW、MinIO、SeaweedFS(S3 / Filer) 文件存储:CephFS、HDFS、CubeFS、JuiceFS、SeaweedFS(Filer + Volume) 3. 对存储系统核心技术具备系统性理解与实践经验,包括:元数据设计(KV、分片、层级命名空间、缓存一致性);多副本、纠删码(EC)、数据重建与故障自愈;小文件优化、热点控制、高并发 IO 及尾延迟治理 4. 熟悉 Linux 存储与 IO 相关机制(VFS、Page Cache、网络 IO)者优先 5.…
工作职责
1. 负责公司云原生存储体系的整体架构设计、关键技术选型及持续演进 2. 深度参与或主导对象存储、分布式文件存储系统的设计、落地与性能优化 3. 在生产环境中建设和演进存储能力,覆盖日志、图片、音视频、小文件、数据平台等核心业务场景 4. 深入分析并优化存储系统关键路径,包括元数据服务、数据读写路径、Volume/Sharding 设计、数据恢复与重平衡 5. 结合 Kubernetes 与云原生生态,设计和落地存储平台能力,包括 CSI、动态供给、快照、扩缩容、多租户与 QoS 6. 推动存储能力与数据平台(湖仓一体、OLAP)、AI/大数据计算等上层系统的深度融合 7. 在关键技术问题上提供专家级判断,指导和提升团队整体技术能力

职位介绍加入我们,你将会参与由第四范式自主研发的多模态大模型基础架构研发工作,和经验丰富的工程师以及科学家一起,参与到业界领先的多模态大模型训练任务中。主要工作内容包括但不限于: • 探索基于云原生的分布式多模态大模型训练任务调度方案,在GPU虚拟化,训练任务的拓扑优化方向找寻新的可能性 • 探索基于云原生的分布式多模态大模型训练的的网络和存储解决方案,优化整体集群的网络和存储效率
我们正在招募经验丰富,技术卓越的云原生平台后端研发工程师,主要负责云原生PaaS平台的框架设计优化和开发迭代工作,您将深入参与推荐系统引擎和模型服务部署管控全流程,为推荐系统云原生构建提供关键技术支撑。 主要职责: 1、参与 PaaS 平台的架构设计与开发,优化系统性能和可扩展性,保障平台的高性能和稳定性; 2、设计和实现高效的微服务架构,保障推荐系统引擎和模型服务部署管控的高效性和高可用性; 3、监控和分析系统性能,针对问题给出可落地的解决方案; 4、与产品经理、前端工程师和运维团队紧密合作,高效推动项目的进展; 5、进行代码框架整合与优化,确保代码的可扩展性和可维护性。
1.AI 原生架构设计: 负责云原生数据库(存算分离架构)的 AI 能力增强,设计并实现面向大规模向量数据的存储、索引及计算架构; 2.高性能内核研发: 在数据库内核中注入AI特性,增强优化器,列存,HTAP以及DB自调优等核心特性; 3.湖仓一体演进: 推动数据库与 Apache Iceberg 等开放表格式的融合,构建 AI 友好的湖仓基础设施,解决非结构化数据与结构化数据的关联检索难题; 4.稳定性与自愈建设: 应对 Serverless 场景下的极速伸缩挑战,利用混沌工程提升分布式环境下的数据一致性与高可用性; 5.前沿探索: 持续跟进 AI4DB(利用 AI 优化数据库参数/查询)与 DB4AI(数据库内置模型推理)方向的最新研究并推动工程落地。