职位编号 J20260826214820131781
资深研发专家(大模型推理引擎方向)4398
100-200万北京市上海市广州市深圳市本科8-10年招聘 4 人预计佣金 259.8K8月26日 21:58刷新/8月26日 21:55发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:加微信,进项目群拿手册:130/3315/1253
优先条件:加微信,进项目群拿手册:130/3315/1253
目标公司/行业:加微信,进项目群拿手册:130/3315/1253
必问问题:
待发单方补充
JD基本信息
岗位职责
1. 推理全链路架构规划:负责大模型推理引擎的整体架构设计及开发,制定技术路线图,支撑千卡/万卡级AI算力集群。
2. 推理引擎构建:负责推理引擎架构演进,深入研究Continuous Batching、量化推理、投机解码、PD分离、KVCache等核心技术,打造极致低延迟、高并发的推理方案。有大模型训练经验优先,有RLHF、GRPO、DAPO等强化学习经验优先。
3. 软硬协同与稳定性:与芯片、算子、集群调度、KV Cache、可观测及平台产品团队协作,完成昇腾等国产硬件的适配与性能调优,主导建设推理全链路的稳定性与SLA保障体系,推动推理能力产品化和规模化落地。
4. 技术前瞻与团队管理:跟踪AI系统领域前沿技术,主导关键技术决策与难点攻关,指导与培养团队成员。
任职要求
1.本科及以上学历,并取得相应学位,计算机及相关专业优先。
2.8年及以上工作经验,其中至少5年以上高性能计算、分布式系统或机器学习系统研发经验。
3.精通Python/C++/Go 一种或多种编程语言,精通vLLM/SGLang/TensorRT-LLM等推理引擎内核实现,对KV Cache、Paged Attention、Prefix Caching、PD 分离、投机解码等关键技术有深度实战经验。
4.精通CUDA编程,熟悉NCCL/RDMA高性能网络、XLA/MLIR编译优化。
5.有从0到1搭建大规模推理系统的经验,能带领团队完成复杂技术攻关,具备跨团队协同能力。有顶会论文或高影响力开源贡献者优先。
6.加分项:熟悉昇腾910B/910C及华为CANN异构计算栈,有RLHF、GRPO、DAPO全流程训练系统的工程落地经验,有大规模在线推理服务(日请求千万级)的架构与运维经验。
7.具备卓越的战略思维与执行能力,有较强的组织领导、沟通和协调能力;具有良好的敬业精神和职业道德操守,企业忠诚度高,并有丰富的团队建设与管理经验。
所属行业:通信/网络设备
职能分类:技术经理
工作城市:
北京,招聘1人,详细地址:北京研发中心工作地址:北京市海淀区学院路42号中国电信博物馆上海,招聘1人,详细地址:上海研发中心工作地址:上海市浦东新区秀沿西路189号中国电信信息园区25号楼广州,招聘1人,详细地址:广州研发中心工作地址:
广报中心:广州市海珠区阅江西路366号广报中心南塔(1号楼)19楼深圳,招聘1人,详细地址:深圳研发中心工作地址:深圳市福田区信息枢纽大厦3楼
职位要求
学历要求:本科
工作年限:8-10年
薪资福利
年薪范围:100-200万 15薪
薪资福利:-
面试信息
面试轮次:0轮
视频面试:不可以接受
面试流程:-