
WiFi万能钥匙数据开发工程师
社招全职3年以上地点:上海状态:招聘
任职要求
1、计算机/软件/数学/统计等相关专业本科以上教育背景,3年及以上工作经验; 2、熟悉大数据相关技术栈,如Hadoop/Hive/Click House/StarRocks/Flink/Spark/等; 3、熟练使用Java、Python/R等开发语言中的一种…
登录查看完整任职要求
微信扫码,1秒登录
工作职责
1、基于Hadoop/Hive/Click House/StarRocks/Flink/Spark等平台技术进行数据仓库建设和数据开发; 2、负责业务数据模型设计,ETL实施,ETL性能优化以及相关技术问题解决; 3、负责用户画像、热点画像、内容标签体系等数据体系建设工作; 4、负责面向业务的OLAP、报表、数据产品和数据应用开发工作。
包括英文材料
大数据+
https://www.youtube.com/watch?v=bAyrObl7TYE
https://www.youtube.com/watch?v=H4bf_uuMC-g
With all this talk of Big Data, we got Rebecca Tickle to explain just what makes data into Big Data.
Hadoop+
https://www.runoob.com/w3cnote/hadoop-tutorial.html
Hadoop 为庞大的计算机集群提供可靠的、可伸缩的应用层计算和存储支持,它允许使用简单的编程模型跨计算机群集分布式处理大型数据集,并且支持在单台计算机到几千台计算机之间进行扩展。
[英文] Hadoop Tutorial
https://www.tutorialspoint.com/hadoop/index.htm
Hadoop is an open-source framework that allows to store and process big data in a distributed environment across clusters of computers using simple programming models.
Hive+
[英文] Hive Tutorial
https://www.tutorialspoint.com/hive/index.htm
Hive is a data warehouse infrastructure tool to process structured data in Hadoop. It resides on top of Hadoop to summarize Big Data, and makes querying and analyzing easy.
https://www.youtube.com/watch?v=D4HqQ8-Ja9Y
StarRocks+
https://docs.starrocks.io/docs/quick_start/
These Quick Start guides will help you get going with a small StarRocks environment.
https://itnext.io/introduction-to-starrocks-a-new-modern-analytical-database-1db2177d26e1
Recently, I had the opportunity to explore StarRocks which is the new kid in the block when talking about massive scale databases which are able to handle petabytes of data.
Flink+
https://nightlies.apache.org/flink/flink-docs-release-2.0/docs/learn-flink/overview/
This training presents an introduction to Apache Flink that includes just enough to get you started writing scalable streaming ETL, analytics, and event-driven applications, while leaving out a lot of (ultimately important) details.
https://www.youtube.com/watch?v=WajYe9iA2Uk&list=PLa7VYi0yPIH2GTo3vRtX8w9tgNTTyYSux
Today’s businesses are increasingly software-defined, and their business processes are being automated. Whether it’s orders and shipments, or downloads and clicks, business events can always be streamed. Flink can be used to manipulate, process, and react to these streaming events as they occur.
Spark+
[英文] Learning Spark Book
https://pages.databricks.com/rs/094-YMS-629/images/LearningSpark2.0.pdf
This new edition has been updated to reflect Apache Spark’s evolution through Spark 2.x and Spark 3.0, including its expanded ecosystem of built-in and external data sources, machine learning, and streaming technologies with which Spark is tightly integrated.
还有更多 •••
相关职位
校招数据与算法类
1. 负责公司数据仓库的架构设计、建模; 2. 组织数据仓库开发,基于数据仓库,对数据进行挖掘,发现数据中的规律,或者负责应用和构建数学算法,以发现数据中的规律(算法); 3. 基于京东海量数据,进行深度数据挖掘,赋能京东高速业务发展,充分发挥数据价值; 4. 理解业务需求,建立可靠的数据收集、发布和处理平台,参与离线/实时数据仓库以及Pipeline的设计和开发; 5. AI应用探索:关注AI在数据工程领域的应用,运用AI工具辅助数据管道开发、数据质量监控及自动化运维,提升数据开发效率。
更新于 2026-07-23北京
社招3-5年数据开发岗
1. 负责数据平台的开发与维护工作,根据业务需求,进行数据仓库的设计与构建,确保数据准确性与数据质量; 2. 深入理解业务,通过高效的数据处理手段,为决策提供数据支持,推动业务发展; 3. 负责数据集成、数据清洗、数据建模等数据处理工作,优化数据处理流程,提升数据处理效率; 4. 与团队紧密协作,通过技术手段解决复杂的数据问题,共同推动项目进度,达成业务目标; 5. 跟踪并研究数据领域的前沿技术,不断探索新技术在业务中的应用,促进业务创新与发展。
更新于 2025-10-08北京
社招2-4年数据开发岗
1. 负责业务数据资产相关工作的研发与建设,实现数据资产的有效管理,加速业务数据分析与使用数据效率; 2. 利用大数据技术,对海量数据进行ETL,对数据加工链接进行优化,实现流批一体计算,保障离线与实时场景下的数据实效性,全链路的准确、稳定和可靠。
更新于 2025-10-12北京