职位编号 J20260820180207130642
运维/sre
37-75万深圳市本科5-8年招聘 1 人预计佣金 89.8K1天前刷新/8月22日 10:30发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:5 年以上生产环境运维、SRE、DevOps、平台工程或基础设施工程经验
优先条件:理解可观测性体系,熟悉 Prometheus、Grafana、ELK/EFK、*、Jaeger 等一种或多种工具
目标公司/行业:有大厂背景
必问问题:
待发单方补充
JD基本信息
岗位职责
为什么加入 DeepWisdom 运维基建团队?
我们正在构建 AI 原生的软件生产与业务落地平台,我们的产品不只是生成代码,而是让想法能够真正进入生产环境,跑通部署、运行、监控、迭代和商业闭环。基础设施在这里是产品能力本身:每一次部署、每一个云函数、每一次业务上线,都依赖一套足够稳定、自动化、可观测、可扩展的底层系统。
我们正身处 AI 原生软件与商业落地范式重构的最前沿。你将亲手建设支撑 AI Agent、云函数、应用托管、自动化部署、多云资源调度和可观测性的基础设施平台。这个岗位是用系统化思维、自动化工具和 Agent 能力,重塑新一代 AI 应用平台的运维与稳定性体系。
任职要求
具备 Critical Thinking 与强烈的闭环意识,面对复杂线上问题,能够快速拆解、定位根因、推动修复,并沉淀为长期机制。
- 5 年以上生产环境运维、SRE、DevOps、平台工程或基础设施工程经验。
- 对 AI Agent、AI 工具链、自动化运维和平台工程有丰富实践经验以及强烈兴趣,愿意用新工具重塑传统运维方式。
- 熟悉 Linux、网络、容器、Kubernetes、CI/CD、网关、监控告警等基础设施核心能力。
- 具备基础开发能力,熟悉 Go / Python / Shell 中至少一种,能够通过代码解决重复性和复杂性问题。
- 理解可观测性体系,熟悉 Prometheus、Grafana、ELK/EFK、OpenTelemetry、Jaeger 等一种或多种工具。
- 有云平台实践经验,熟悉 AWS、GCP 或其他云厂商中的一种或多种。
- 具备强烈的稳定性意识,能从 SLA、错误率、延迟、容量、成本、故障半径等角度思考系统。
- 能在速度、稳定性、安全和成本之间做合理权衡,知道什么时候该快速止血。
职位要求
你将创造什么
打造支撑 Vibe Business 高速增长的稳定性与自动化基础设施,让 AI 原生应用的创建、部署、运行和恢复都足够快、足够稳、足够可控。
- 建设和优化 CI/CD、发布、回滚、灰度、环境管理等工程效率体系,让研发团队可以更快、更安心地交付。
- 设计并完善监控、日志、Tracing、告警和事件响应体系,推动问题从“被动救火”走向“主动预防”。
- 参与云函数、应用托管、镜像仓库、域名、证书、网关路由等平台能力的自动化建设。
- 推动高可用架构、容量规划、故障演练、灾备恢复、成本优化和安全加固。
- 与工程、算法、产品和全栈团队紧密协作,识别系统瓶颈,推动跨团队可靠性改进。
- 沉淀故障复盘、SOP 和自动化工具,让每一次线上问题都成为系统进化的起点。
所属行业:人工智能/大模型/算力
职能分类:大模型算法
工作城市:
深圳,招聘1人,详细地址:深圳市南山区深南大道 9966 号 威盛科技大厦 2102
职位要求
学历要求:本科·统招
工作年限:5-8年
薪资福利
年薪范围:37-75万 15薪
薪资福利:-
面试信息
面试轮次:轮
视频面试:不可以接受
面试流程:-