职位编号 J20260819175956130329
运维开发工程师
100-200万北京市本科5-8年招聘 1 人预计佣金 221.2K2天前刷新/8月24日 09:01重新发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:3年以上集群运维/SRE经验;
2、精通以下至少3项:
分布式系统原理:HDFS/YARN/Spark/Flink/Kafka/*工作原理及调优;
运维技术栈:Linux内核调优、网络(TCP/IP)、容器化(Docker/K8s);
自动化开发:Python/Go/Shell脚本开发能力;
可观测工具:Prometheus/Grafana/ELK/*;
3、熟悉云原生大数据服务者优先;
4、主导过100+节点集群的稳定性治理经历优先。
优先条件:3年以上集群运维/SRE经验;
2、精通以下至少3项:
分布式系统原理:HDFS/YARN/Spark/Flink/Kafka/*工作原理及调优;
运维技术栈:Linux内核调优、网络(TCP/IP)、容器化(Docker/K8s);
自动化开发:Python/Go/Shell脚本开发能力;
可观测工具:Prometheus/Grafana/ELK/*;
3、熟悉云原生大数据服务者优先;
4、主导过100+节点集群的稳定性治理经历优先。
目标公司/行业:私募量化,互联网大厂
必问问题:
待发单方补充
JD基本信息
岗位职责
1、系统可靠性保障:主导Hadoop/YARN、Spark、Flink、Kafka、DolphinScheduler等大数据组件的高可用架构设计、部署、调优和监控与故障应急响应;
2、可观测性体系:设计并落地统一监控告警平台(Prometheus/Grafana + 自定义指标),覆盖从主机到作业粒度的全栈监控;
建设日志分析系统(ELK/Splunk),实现快速故障定位与根因分析,开发智能告警降噪与自愈脚本;
3、自动化与DevOps:开发自动化运维工具(Python/Go/Java),覆盖部署、扩缩容、配置管理、日志收集等场景,构建CI/CD流水线,实现大数据组件无人值守发布与灰度升级,维护Infrastructure as Code(Terraform/Ansible)及配置中心化管理。
任职要求
1、3年以上集群运维/sre经验
2、精通以下至少3项:
分布式系统原理:
3、熟悉云原生大数据服务者优先
4、主导过100+节点集群的稳定性治理经历优先.
职位信息
工作地点
所属行业:互联网、人工智能/大模型/算力、大数据、计算机软件
职能分类:运维开发工程师
工作城市:
北京,招聘1人,详细地址:海淀
职位要求
学历要求:本科·统招·985/211
工作年限:5-8年
薪资福利
年薪范围:100-200万 15薪
薪资福利:-
面试信息
面试轮次:3轮
视频面试:可以接受
面试流程:HR沟通-线下初试-线下复试-HRBP面