logo of bytedance

字节跳动SRE高级工程师-Data

社招全职3年以上A09552地点:杭州状态:招聘

任职要求


1、大学本科及以上学历,计算机相关专业;
2、三年以上运维开发项目经验;
3、掌握常用开发语言Shell/Python/Golang,熟悉业界主流技术,如Open-Falco…
登录查看完整任职要求
微信扫码,1秒登录

工作职责


1、推进优化基础服务的响应延迟、性能问题,提升服务稳定性;
2、负责各种基础系统搭建和维护(DNS、LDAP等);
3、开发自动化运维平台,提高运维、开发协作效率,规范操作流程;
4、优化各种系统,减少重复性工作;
5、负责公司基础监控、报警系统开发与维护。
包括英文材料
学历+
Bash+
Python+
还有更多 •••
相关职位

logo of bytedance
社招3年以上A59704

1、推进优化基础服务的响应延迟、性能问题,提升服务稳定性; 2、负责各种基础系统搭建和维护(DNS、LDAP等); 3、开发自动化运维平台,提高运维、开发协作效率,规范操作流程; 4、优化各种系统,减少重复性工作; 5、负责公司基础监控、报警系统开发与维护。

更新于 2025-03-22杭州
logo of siemens
社招5-10年信息技术

职位概述: 我们正在寻找一位对系统稳定性和高可用性有着极致追求的高级运维工程师。您将成为我们电商及资讯平台基础设施的“守护者”,核心职责是确保生产环境7x24小时高可用,并高效管理从故障发现到恢复的全生命周期。您需要具备深厚的技术功底、冷静的应急心态和强大的复盘能力,通过自动化、流程化和系统化的方法,不断提升我们系统的韧性与可观测性,为亿万用户的顺畅体验保驾护航。 核心职责: 1. 系统高可用性保障: o 负责公司核心业务(电商、资讯)生产环境及基础设施(服务器、网络、数据库、中间件等)的稳定运行,确保服务SLA达到或超过既定目标(如99.99%)。 o 设计、实施和维护高可用和容灾架构,包括同城双活、异地灾备等方案的落地与演练。 2. 监控与应急响应: o 主导建设和优化集中式监控、日志分析与告警系统(如Prometheus/Grafana, ELK, Zabbix, Datadog等),确保能提前预警、快速发现问题。 o 作为主要事故处理指挥官(Incident Commander),负责7x24小时应急响应,领导并协调相关团队对线上事故进行快速定位、止损和恢复,最大限度降低影响。 3. 事故全生命周期管理: o 严格遵循ITIL等最佳实践,管理事故(Incident)和处理工单(Ticket)。 o 主导重大事故复盘(Post-mortem),编写详尽的复盘报告,深入分析根因,并推动落实改进措施(如代码修复、流程优化、架构调整等),避免同类问题重复发生。 4. 运维自动化与效率提升: o 通过编写脚本(Shell/Python/Go等)和利用自动化工具(Ansible/Terraform等),自动化日常运维操作和故障处理流程,提升效率,减少人为失误。 o 践行SRE(Site Reliability Engineering)理念,通过代码管理基础设施(IaC)。 5. 容量规划与性能优化: o 定期进行系统容量评估和规划,确保系统有能力应对业务增长和突发流量(如大促活动)。 o 分析系统性能瓶颈,协同开发团队进行调优,提升系统效率和资源利用率。 6. 系统组件的安全升级及维护: o 常规维护能力:具备使用安全扫描工具进行安全漏洞扫描额能力。 能全程跟进系统组件安全管理,做好版本监控、漏洞扫描与风险评估,按计划升级部署补丁、更新配置,快速应对突发安全事件,降低业务受影响程度。 o 借助工具强化能力:熟练使用安全卫士等工具,将其融入维护流程。实现自动化漏洞检测与修复建议输出,实时监控异常与潜在威胁并预警阻断,利用日志分析优化安全策略,构建闭环安全管理体系。

更新于 2025-09-30深圳
logo of tesla
社招软件平台

The Role Come join a small team of experts building the systems that connect Tesla and our customers to their cars, robotaxis, robots, and energy products. At Tesla, we’re at the forefront of connected innovation providing a suite of rich backend services to our growing fleets. The team operates the UI and services behind developer.tesla.com. We own the platform that enables owners to interact with their cars and developers to build device-connected applications. The platform includes Authentication systems and other back-end services powering vehicles and mobile apps. You will evolve across the tech stack to deliver features to millions of customers and improve our products. We are looking for a highly motivated software engineer specialized in web services and distributed systems. The platform you build will scale novel functionality to millions of users and devices.

上海
logo of bytedance
社招3年以上A91599A

1、负责Sdwan网络的日常运维、监控和故障排除,及时响应并解决网络故障和性能问题; 2、构建和维护Sdwan网络的监控和告警系统,实现对网络状态的全面监控和预警; 3、开发和维护自动化运维工具和脚本,提高运维效率,减少人为错误,并负责编写和维护Sdwan网络相关的文档和知识库; 4、参与容量规划和性能测试,确保Sd-wan网络能够满足业务需求。

更新于 2025-01-08北京