职位编号 J20260809014550128031
大模型运维开发
70-150万北京市本科不限招聘 5 人预计佣金 155.5K2天前刷新/8月9日 22:04发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:第一学历211以上 精通以下至少3项: 分布式系统原理:HDFS/YARN/Spark/Flink/Kafka/*工作原理及调优; 运维技术栈:Linux内核调优、网络(TCP/IP)、容器化(Docker/K8s); 自动化开发:Python/Go/Shell脚本开发能力; 可观测工具:Prometheus/Grafana/ELK/*;
优先条件:加分项 熟悉云原生大数据服务者优先;
目标公司/行业:目标公司:互联网或者IT类公司均可,BAT,字节滴滴美团快手小红书,或者金融类 AI 创业类公司
必问问题:
  • 看机会原因,现司职级
  • 当前年包,期望薪酬
  • 目前有无offer,有几个面试流程,初期还是后期
  • 近两年绩效,到岗时间
JD基本信息
岗位职责
工作职责 1、系统可靠性保障:主导Hadoop/YARN、Spark、Flink、Kafka、DolphinScheduler等大数据组件的高可用架构设计、部署、调优和监控与故障应急响应; 2、可观测性体系:设计并落地统一监控告警平台(Prometheus/Grafana + 自定义指标),覆盖从主机到作业粒度的全栈监控; 建设日志分析系统(ELK/Splunk),实现快速故障定位与根因分析,开发智能告警降噪与自愈脚本; 3、自动化与DevOps:开发自动化运维工具(Python/Go/Java),覆盖部署、扩缩容、配置管理、日志收集等场景,构建CI/CD流水线,实现大数据组件无人值守发布与灰度升级,维护Infrastructure as Code(Terraform/Ansible)及配置中心化管理。
任职要求
任职要求 1、3年以上集群运维/SRE经验; 2、精通以下至少3项: 分布式系统原理:HDFS/YARN/Spark/Flink/Kafka/DolphinScheduler工作原理及调优; 运维技术栈:Linux内核调优、网络(TCP/IP)、容器化(Docker/K8s); 自动化开发:Python/Go/Shell脚本开发能力; 可观测工具:Prometheus/Grafana/ELK/OpenTelemetry; 3、熟悉云原生大数据服务者优先; 4、主导过100+节点集群的稳定性治理经历优先
所属行业:互联网、人工智能/大模型/算力、计算机软件
职能分类:运维开发工程师
工作城市:
北京,招聘5人,详细地址:海淀区清华科技园
职位要求
学历要求:本科·统招·985/211
工作年限:不限
薪资福利
年薪范围:70-150万 16薪
薪资福利:-
面试信息
面试轮次:3轮
视频面试:可以接受
面试流程:-