logo of mihoyo

米哈游数据爬虫工程师

社招全职3年以上国际化类地点:上海状态:招聘

任职要求


1、本科及以上学历,计算机科学、软件工程、数据科学等相关专业;
2、3年以上爬虫开发经验,具备大规模分布式爬取与数据处理经验者优先;
3、精通 Python,熟悉主流爬虫框架(如 Scrapy、PlaywrightSelenium 等),具备良好的前端结构分析与反爬破解能力;
4、熟悉 Kafka、Redis、MySQL、MongoDB 等常用中间件与数据库,了解 Lin…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、遵循robots协议,爬取互联网上允许爬虫采集的公开信息;
2、参与爬虫平台架构设计与基础建设,维护爬取及数据处理任务,保障各类渠道数据的稳定性与正确性;
3、攻克各种爬虫技术难关,提升爬虫平台效果与性能;
4、支持业务团队的数据采集、渠道接入及系统维护等需求,实现数据驱动的业务增长。
包括英文材料
学历+
数据科学+
Python+
Playwright+
Selenium+
Kafka+
还有更多 •••
相关职位

logo of tencent
社招3年以上AI技术

1.负责大规模网页数据的抓取、清洗及结构化存储,保障数据质量和时效性; 2.设计并优化分布式爬虫架构,提升系统并发能力和容错性,提升系统性能; 3.维护数据采集链路,协同系统数据分析团队完成数据交付与应用。

更新于 2025-11-21深圳
logo of meitu
社招研发类

负责 Hadoop、Spark、Hive、HBase、Presto、Flink、ClickHouse 等大数据集群的规划、部署与算力调优,保障集群 7×24 小时稳定运行。 负责集群日常运维、性能调优、容量规划、故障排查与问题根治,保障服务达成 SLA 指标。 负责大数据开源组件二次封装、功能迭代与漏洞修复,搭建通用工具与服务,赋能数据平台建设。 为数据分析团队提供底层技术支撑,协助解决平台使用过程中各类复杂技术问题。算机、软件工程、数学等相关专业,本科及以上学历,拥有 3 年及以上大数据研发相关工作经验。 具备中大型集群(PB 级数据量或 50~100 节点规模)整体规划、搭建与优化实战经验。 有 Hadoop、Spark、Hive、Presto 等开源框架源码修改、二次开发经验者优先。 精通 Hadoop、Spark、Hive、HBase、Presto、Flink、ClickHouse 等主流大数据生态组件。 熟练使用 Java、Python、Shell 进行开发,精通 HiveSQL 性能调优。 可独立完成需求分析、技术选型,能够设计高可用、高可扩展的大数据解决方案。 具备钻研精神与自驱力,沟通表达良好,拥有较强的抗压能力及集群应急处置能力。 具备 AI 开发能力,熟练使用主流 AI 编程提效工具(如 Codex、CodeCopilot 等)。 拥有大数据场景下大模型 Agent 设计、开发及项目落地经验者优先。 了解或掌握机器学习算法底层原理者优先。 ## Key Responsibilities * Design, deploy, optimize, and maintain large-scale big data clusters based on technologies such as Hadoop, Spark, Hive, HBase, Presto, Flink, and ClickHouse. * Ensure 24×7 stability, reliability, and performance of production data platforms through proactive monitoring, capacity planning, and performance tuning. * Troubleshoot complex system issues, conduct root cause analysis, and implement long-term solutions to meet SLA requirements. * Develop and enhance internal platform capabilities through customization, secondary development, feature enhancements, and bug fixes of open-source big data components. * Build reusable tools, frameworks, and platform services to improve engineering efficiency and support data platform evolution. * Provide technical guidance and infrastructure support for data analysts, data engineers, and business teams, helping resolve complex platform-related challenges. * Participate in architecture design, technology evaluation, and best-practice establishment for enterprise-scale data platforms. ##

更新于 2026-06-12厦门
logo of meituan
社招3年以上食杂零售-公共部

岗位职责: 1.使用各类数据挖掘技术及机器学习算法以及大模型等前沿技术,基于海量多模态行为数据,构建完整的用户画像与兴趣建模体系,精准刻画用户行为。 2.结合对业务理解,深入挖掘数据价值,将业务问题转化为可建模的算法问题并推动在业务场景下应用,拿到业务结果。 3.深入思考产品业务价值,参与制定及落实团队在技术、业务等多维度发展方向。 4.深入理解食杂零售餐饮供应链业务逻辑和运营模式,与业务、产品、工程、数据等团队紧密协同,完成从业务问题到算法问题的抽象与定义,设计指标体系,进行算法技术选型和方案设计实现,推动落地应用。

更新于 2026-06-16北京
logo of tcl
实习战略运营

1、数据处理 (100) 1. 负责行业、市场、竞品及公司经营相关数据的搜集、清洗、整理与汇总,维护数据台账。 2. 协助完成日常数据统计、核对、复盘,输出标准化数据报表,排查数据异常问题。 3. 协助整理行业资讯、政策、案例资料,配合撰写、校对战略分析及部门各类报告。 4. 负责部门数据、文档资料的归档整理,配合完成战略专项项目辅助工作。

更新于 2026-06-15深圳