京东数据开发岗
社招全职5年以上数据开发岗地点:广东状态:招聘
任职要求
1. 教育背景 学历要求:本科及以上学历,计算机科学、数学、统计学、精算等相关专业优先; 2. 工作经验 工作经验:具备5年以上大数据开发与数据仓库建设经验,有金融行业(如保险、银行)数据平台或监管数据项目经验者优先; 3. 能力要求: 数仓建模能力:精通维度建模(Kimball)或Data Vault等理论,具备复杂业务场景下的数据模型设计与落地能力; 大数据技术栈:深入理解Hadoop生态及MPP架构,熟练掌握Hive、Spark、Flink、Kafka、HBase等组件的原理及开发调优,具备TB/PB级数据采集、清洗、整合与加工及离线与实时数据处理流水线构建经验; 性能优化能力:具备SQL(HiveSQL/SparkSQL)复杂查询编写与深度调优能力,能解决数据倾斜、内存溢出等性能瓶颈,保障数据产出SLA; 数据治理能力:熟悉数据标准、元数据及数据质量体系建设,具备开…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1. 负责保险业务数据仓库、数据集市及数据湖的建模与开发,基于Hadoop/Spark/Flink等大数据技术栈,构建离线与实时数据处理流水线,支撑精算、理赔、营销、风控等核心业务场景; 2. 负责TB/PB级海量数据的采集、清洗、整合与加工,深入理解Hadoop生态及MPP架构,对SQL、Spark任务进行深度调优,解决数据倾斜、内存溢出等性能瓶颈,保障数据产出的SLA; 3. 参与数据标准、元数据及数据质量体系建设,开发自动化数据校验规则与监控告警机制,确保报表及经营分析数据的准确性、一致性与完整性; 4. 深度参与智能核保、理赔反欺诈、精准营销、客户流失预警等AI场景的模型建设,负责特征工程、样本构建及模型部署的数据链路保障,推动算法模型的业务落地与效果迭代; 5. 跟进大数据前沿技术(如Data+AI、湖仓一体、实时计算),参与大数据平台核心组件的选型、二次开发及运维体系建设,提升平台的稳定性、扩展性与易用性; 6. 推动数据资产化,挖掘数据价值,为业务决策提供底层数据支撑,并具备良好的跨部门沟通协作能力,推动业务与技术的深度融合。
包括英文材料
学历+
大数据+
https://www.youtube.com/watch?v=bAyrObl7TYE
https://www.youtube.com/watch?v=H4bf_uuMC-g
With all this talk of Big Data, we got Rebecca Tickle to explain just what makes data into Big Data.
数据仓库+
https://www.youtube.com/watch?v=9GVqKuTVANE
From Zero to Data Warehouse Hero: A Full SQL Project Walkthrough and Real Industry Experience!
https://www.youtube.com/watch?v=k4tK2ttdSDg
Vault+
[英文] Tutorials | Vault
https://developer.hashicorp.com/vault/tutorials
Centrally store, access and deploy secrets
https://www.youtube.com/watch?v=klyAhaklGNU
Full HashiCorp Vault Tutorial explaining What is HashiCorp Vault, How Vault works, Vault Architecture
Hadoop+
https://www.runoob.com/w3cnote/hadoop-tutorial.html
Hadoop 为庞大的计算机集群提供可靠的、可伸缩的应用层计算和存储支持,它允许使用简单的编程模型跨计算机群集分布式处理大型数据集,并且支持在单台计算机到几千台计算机之间进行扩展。
[英文] Hadoop Tutorial
https://www.tutorialspoint.com/hadoop/index.htm
Hadoop is an open-source framework that allows to store and process big data in a distributed environment across clusters of computers using simple programming models.
Hive+
[英文] Hive Tutorial
https://www.tutorialspoint.com/hive/index.htm
Hive is a data warehouse infrastructure tool to process structured data in Hadoop. It resides on top of Hadoop to summarize Big Data, and makes querying and analyzing easy.
https://www.youtube.com/watch?v=D4HqQ8-Ja9Y
Spark+
[英文] Learning Spark Book
https://pages.databricks.com/rs/094-YMS-629/images/LearningSpark2.0.pdf
This new edition has been updated to reflect Apache Spark’s evolution through Spark 2.x and Spark 3.0, including its expanded ecosystem of built-in and external data sources, machine learning, and streaming technologies with which Spark is tightly integrated.
还有更多 •••
相关职位
社招2年以上数据开发岗
1.广告数据体系建设:负责京东广告实时与离线数据全链路建设,涵盖数据接入、流批处理及OLAP分析,构建高可用、低成本、易扩展的数仓体系,持续提升数据资产质量,支撑广告策略、算法模型与投放决策等多样化用数需求; 2.高性能数据链路优化:面向海量广告数据,持续突破计算效率、存储成本与查询延迟,通过架构升级、算力优化打造低延迟、高可用的数据链路,核心支撑效果分析、实时出价等关键业务场景; 3.AI驱动的数据智能:探索AI在智能ETL、自动化建模及数据质量监控与诊断体系等数据工程场景的落地,沉淀通用工具与平台能力,提升研发效能与数据智能化水平,为算法与业务决策提供智能数据支持。
更新于 2026-06-25海南
社招5年以上数据开发岗
1.负责京东物流财务大数据研发工作,承担数据开发需求。 2.负责财务数据核心代码开发,解决数据开发过程技术中关键问题和技术难点; 3.深刻理解大数据相关技术栈,了解财务场景,不断提升数据研发质量,持续加强用户体验;
更新于 2026-06-29北京
社招3-5年数据开发岗
1.基于海量用户行为数据,建立和完善京东科技用户人群、画像、OneID等数据资产体系,持续优化数据模型,产生用户标签,将其应用到运营、投放、策略优化等营销场景; 2.主导用户画像需求分析,把控用户画像建设方向,通过业务要素分析驱动标签扩展; 3.协助用户对画像数据进行使用,挖掘价值,沉淀公司标签类数据资产; 4.跟踪并研究数据领域的前沿技术,不断探索新技术在业务中的应用,促进业务创新与发展。
更新于 2025-11-25北京