职位编号 J20260809014550128031
大模型运维开发
70-150万北京市本科不限招聘 5 人预计佣金 155.5K2天前刷新/8月9日 22:04发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:第一学历211以上
精通以下至少3项:
分布式系统原理:HDFS/YARN/Spark/Flink/Kafka/*工作原理及调优;
运维技术栈:Linux内核调优、网络(TCP/IP)、容器化(Docker/K8s);
自动化开发:Python/Go/Shell脚本开发能力;
可观测工具:Prometheus/Grafana/ELK/*;
优先条件:加分项
熟悉云原生大数据服务者优先;
目标公司/行业:目标公司:互联网或者IT类公司均可,BAT,字节滴滴美团快手小红书,或者金融类 AI 创业类公司
必问问题:
- 看机会原因,现司职级
- 当前年包,期望薪酬
- 目前有无offer,有几个面试流程,初期还是后期
- 近两年绩效,到岗时间
JD基本信息
岗位职责
工作职责
1、系统可靠性保障:主导Hadoop/YARN、Spark、Flink、Kafka、DolphinScheduler等大数据组件的高可用架构设计、部署、调优和监控与故障应急响应;
2、可观测性体系:设计并落地统一监控告警平台(Prometheus/Grafana + 自定义指标),覆盖从主机到作业粒度的全栈监控;
建设日志分析系统(ELK/Splunk),实现快速故障定位与根因分析,开发智能告警降噪与自愈脚本;
3、自动化与DevOps:开发自动化运维工具(Python/Go/Java),覆盖部署、扩缩容、配置管理、日志收集等场景,构建CI/CD流水线,实现大数据组件无人值守发布与灰度升级,维护Infrastructure as Code(Terraform/Ansible)及配置中心化管理。
任职要求
任职要求
1、3年以上集群运维/SRE经验;
2、精通以下至少3项:
分布式系统原理:HDFS/YARN/Spark/Flink/Kafka/DolphinScheduler工作原理及调优;
运维技术栈:Linux内核调优、网络(TCP/IP)、容器化(Docker/K8s);
自动化开发:Python/Go/Shell脚本开发能力;
可观测工具:Prometheus/Grafana/ELK/OpenTelemetry;
3、熟悉云原生大数据服务者优先;
4、主导过100+节点集群的稳定性治理经历优先
所属行业:互联网、人工智能/大模型/算力、计算机软件
职能分类:运维开发工程师
工作城市:
北京,招聘5人,详细地址:海淀区清华科技园
职位要求
学历要求:本科·统招·985/211
工作年限:不限
薪资福利
年薪范围:70-150万 16薪
薪资福利:-
面试信息
面试轮次:3轮
视频面试:可以接受
面试流程:-