快手大数据开发工程师-【数据引擎】
任职要求
1、本科及以上学历,计算机科学与技术、软件工程或相关专业方向; 2、熟练掌握Java/Scala/Rust,有扎实的计算机基础,对数据结构、算法基础有扎实掌握,对计算机体系结构、操作系统、计算机网络有深刻理解; 3、掌握数据湖理论与技术、文献,熟悉行业内成熟的数据湖服务,例如Hudi、Iceberg、Paimon、Lance 等,开源社区有贡献者优先; 4、掌握分布…
工作职责
1、为公司 AI 和 BI 业务场景提供 data engineering 能力,包括可灵、商业化、电商、主站等业务;既支持结构化数据、也支持多模态数据; 2、团队有超过一半的 Apache Committer / PMC(Hudi / Paimon / Amoro / Flink/ RocketMQ),与开源社区紧密合作,持续构建开源影响力,有机会成长为 Apache Committer / PMC; 3、打造行业领先的数据湖服务,提供高效、极简的EB级数据存储与处理能力。推进快手数据体系的全面的湖仓化; 4、跟进学术界,工业界成熟的经验与技术,规划与推进快手数据体系的不断演进与迭代。
1、基于阿里云大数据计算平台,对海量游戏及相关业务数据进行采集、处理、建模与分析,支撑搜索、推荐、用户运营、精准投放等业务需求; 2、参与用户画像、搜索引擎、个性化推荐等系统的架构设计与开发,实现高性能、可扩展的数据服务平台; 3、负责服务端Java 应用的架构与开发,完成接口服务、业务逻辑、数据访问层实现,保证系统的安全性、稳定性与和可扩展性; 4、对业务需求进行分析、与产品团队沟通确认,完成技术方案设计、风险评估及落地实施; 5、持续关注行业技术动态和前沿技术,在大数据计算、搜索与推荐、Al应用等领域不断探索与落地。
1. 参与智能引擎事业部大数据平台的开发、设计与维护工作,打造高可靠、低成本、简单易用的 Flink 实时计算和大数据技术中台; 2. 支持阿里集团AI数据的全面入湖,完善湖仓一体存储与优化,降低用户使用数据的门槛; 3. 参与搜索、广告、推荐、AI 推理等链路的数据处理链路的深度重构,适应大模型场景的需求,打造领域高效的SaaS解决方案。
1、参与公司大数据平台架构的设计、优化与研发工作,涵盖 Spark、Hadoop、HBase、Iceberg 等核心组件 2、根据业务需求,设计高可用、高扩展性、高性能的大数据计算方案 3、参与 Iceberg 数据湖表的架构设计、规范制定与性能调优 4、参与 HBase 集群规划、表设计、预分区策略、热点优化及日常运维支持 5、参与 Spark 作业调优、资源管理与作业框架建设,提升整体计算稳定性与效率 6、配合团队进行 Hadoop 平台建设、集群管理、版本升级与安全策略落地 7、跟踪大数据技术前沿,结合业务场景进行技术预研和落地。

我们是有赞的核心数据团队,主要负责商家后台数据中心的建设与运营。我们致力于打造业界领先的、基于语义层的统一数据服务平台(OneService),构建完善的指标管理体系,赋能商家精细化运营,提升数据驱动决策的效率。加入我们,你将有机会参与从0到1或从1到N构建企业级数据服务核心基础设施的过程。 岗位职责: 1. 负责统一数据服务平台(基于语义层)的设计、研发与持续优化,打造公司级标准、高效、易用的数据消费入口; 2. 负责指标中心/指标管理系统的规划与建设,建立规范化的指标生产、维护、管理流程与配套工具,保障指标口径统一与准确; 3. 提升平台数据服务能力,支持多样化的数据消费场景(如:BI报表、自助分析、数据API、运营活动等),赋能业务实现数据驱动,包括但不限于数据可视化产品,数据赋能运营等场景的设计和落地; 4. 持续优化数据平台的技术架构,提升系统稳定性、查询性能和用户体验,降低数据接入和使用成本; 5. 负责数据产品的开发及维护工作,与数据分析师、产品经理、业务方紧密合作,理解数据需求,将其转化为标准化的数据平台能力。 工作内容: 1. 负责商家数据中心的设计、开发与持续迭代优化(基于离线/实时数仓); 2. 深入参与OneService平台的设计与研发,包括但不限于语义层建模、查询引擎对接、API服务开发、权限管理等核心模块; 3. 负责指标维度管理系统的设计与实现,支持指标的定义、血缘、变更、生命周期管理等功能; 4. 基于Spark/Flink等计算引擎进行数据处理、加工与分析,构建高效、稳定的数据链路; 5. 应用OLAP技术(如Doris, ClickHouse, Kylin等)优化海量数据查询性能,并根据业务场景进行技术选型和实践; 6. 参与数据服务相关在线系统的架构设计与开发,保障服务的高可用和高性能。