职位编号 J20260928114952138153
大模型存储SRE工程师
80-120万深圳市本科5-8年招聘 1 人预计佣金 131K3天前发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:3 年以上文件存储、对象存储、os运维开发经历,相对年轻高潜,base 深圳。
优先条件:
3 年以上文件存储、对象存储、os运维开发经历,相对年轻高潜,base 深圳。
目标公司/行业:阿里云 华为云 等大厂背景
必问问题:
- 是否必须带团队
- 最近一家公司的职级及绩效和期望薪资
JD基本信息
岗位职责
岗位职责
1.负责存储类产品的日常运维,如需求评估、发布变更、容量管理等日常运维工作,以及7×24小时服务稳定性保障;
2.深度理解分布式存储产品架构与核心模块,参与产品需求技术评审和BCP治理,系统性挖掘现网风险隐患与性能瓶颈,制定完备的应急预案并组织定期演练;
3.主导存储产品运维体系的持续演进,构建自动化运营工具与平台能力,基于SRE理念推进故障管理、变更管理、容量管理等核心工程实践与演进;
4.探索AIOps方向的工程实践,包括基于机器学习的异常检测与告警降噪、容量趋势预测及资源管理,以及利用大模型辅助故障问题分析与运维知识沉淀;
5.保持对运维及AI领域技术探索,推进自动化与智能化工具在运维场景的合理应用,提升平台稳定性与运维效率。
任职要求
岗位要求
1.本科及以上学历,计算机、软件工程或相关专业,具备3-5年Linux系统运维工作经验,有SRE岗位经验或DevOps背景者优先;
2.扎实掌握分布式存储系统工作原理,具备对象存储/块存储/文件存储/表格存储等主流存储产品的实际运营经验者优先;
3.深入熟悉Linux操作系统,在网络协议、内核机制、文件系统等方向具备实际排障与优化能力,具备软硬协同工作经验者优先;
4.熟练掌握Shell / Python / Golang 中一种或多种语言,具备运维工具开发能力,有DevOps工具链或SRE平台研发经验者优先;
5.具备数据化运营意识,能够通过可观测性指标体系(如SLI/SLO)驱动存储产品与运维平台的持续优化;了解机器学习基础原理,有将算法模型应用于运维场景(如异常检测、容量预测)的实践经验者优先;
6.对大模型(LLM)在运维辅助领域的应用(如日志分析、运维知识问答)有一定认知或实践经验者优先;
7.具备良好的抗压能力与责任担当,拥有较强的跨团队协作能力,对技术问题保持探究精神,具备主动学习与持续成长的内驱力。
加分项
所属行业:人工智能/大模型/算力
职能分类:运维工程师
工作城市:
深圳,招聘1人,详细地址:腾讯大厦
职位要求
学历要求:本科
工作年限:5-8年
薪资福利
年薪范围:80-120万 15薪
薪资福利:这是一个 10 级-11 级的岗位
面试信息
面试轮次:4轮
视频面试:可以接受
面试流程:业务 leader-总监-总经理-交叉-HR 面试