职位编号 J20260513143546109308
应用运维工程师
40-70万北京市本科3-5年招聘 1 人预计佣金 73.4K22小时前刷新/5月13日 14:54发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:211起
优先条件:知名互联网及AI公司
目标公司/行业:知名互联网及AI公司
必问问题:
待发单方补充
JD基本信息
岗位职责
1. 主导设计与落地 端到端全链路可观测性平台(Metrics, Tracing, Logs),解决当前监控盲区和 MTTR 居高不下的问题。
2. 通过数据分析(SLO/SLI)驱动故障根因分析,并将故障经验沉淀为自动化应急预案(SOP)。
3. 推动 SRE 角色“左移”,参与核心系统的设计评审,确保架构设计满足弹性、任性以及可观测等可运维标准。
4. 通过工具和平台,减少团队 **Toil(琐事)**占比,提高整体自动化水平。
5. 协助建立并推行 SLO/Error Budget 机制,驱动外部依赖组件或服务(如缓存、中间件、算法)实现可靠性“自我负责、自我驱动”。
6. 设计和优化 统一故障指挥体系(ICS) 流程,消除跨团队协作壁垒,确保故障处理角色和责任清晰。
任职要求
1、 全日制本科及以上学历,3年以上相关工作经验;
2、. 精通至少一种编程语言(如 Go, Python),具备开发运维平台工具链的实际经验;
3、 深入理解 分布式系统架构、微服务、高可用性、容灾和容量规划理论;
4.、熟悉主流 可观测性技术栈(如 Prometheus/Thanos, Grafana, ELK/Loki, OpenTelemetry/Jaeger 等);
5.、具备良好的跨团队沟通、协调及文档撰写能力,能够推动技术标准和流程落地。
所属行业:人工智能/大模型/算力
职能分类:运维工程师
工作城市:
北京,招聘1人,详细地址:北京市西城区金融科技中心
职位要求
学历要求:本科
工作年限:3-5年
薪资福利
年薪范围:40-70万 14薪
薪资福利:六险二金
面试信息
面试轮次:3轮
视频面试:不可以接受
面试流程:-