**********************
异构计算与推理系统研究主管
  • 收藏职位
  • 分享职位
75-120万 上海 博士 5-8年 招聘 1 人 预计佣金 143.6K 18:40发布
72小时新发
JD基本信息
岗位职责
【岗位职责】 前沿探索与学术产出(80%): 硬件感知的大模型推理研究(Hardware-aware Inference):针对无问芯穹独有的“M种模型xN种异构芯片”生态,研究下一代面向海量混合异构集群的分布式推理架构、极致调度算法与软硬协同设计(Co-design)。 编译优化与算子极限探索:研究前沿的图编译技术、动态Shape优化、基于异构NPU/GPU的高效算子生成与极限内存优化(Memory-bound优化等)。 顶会论文/专利发表:主导团队在 OSDI、SOSP、ASPLOS、MLSys、ISCA、HPCA 等计算机系统与体系结构顶级会议,以及 NeurIPS、ICLR 等AI顶会发表高质量学术论文,并布局底层技术核心专利。 技术转化与赋能(20%): 开发并验证突破性的推理加速系统原型(如探索端到端延迟的极限压缩),为公司下一代Infra产品规划技术路线图。 将验证成功的系统架构、核心调度算法或极致算子逻辑,交接给底层的无问芯穹Infra工程团队,指导工业级C++/CUDA/Triton代码落地。 顶尖研究团队建设: 建立并带领一支约5人规模的系统架构与异构计算精锐研究团队,指导团队成员攻坚“硬核”系统级科研难题。
任职要求
学术背景:计算机科学、体系结构、电子工程等相关专业博士学历;在系统软件、编译原理、并行计算或体系结构方向有深厚积累。 硬性指标:以第一作者在 OSDI、ASPLOS、MLSys、ISCA、MICRO 等系统/体系结构顶会,或NeurIPS/ICLR等AI顶会发表过高影响力论文。 技术功底: 深入理解大模型底层计算逻辑与并行策略(Tensor Parallel, Pipeline Parallel等)。 熟悉主流推理框架(vLLM, TensorRT-LLM, Megatron等)及底层编译工具链(Triton, TVM, MLIR等)。 具备极强的C++/CUDA/底层汇编级优化理解力,能手撕极致性能的算子原型。 团队领导力:有带领系统方向科研团队的经验,热衷于解决极具挑战性的工程与科学交叉难题。
所属行业:
人工智能/大模型/算力
职能分类:
高性能计算工程师
工作城市:
上海,招聘1人,详细地址:上海市徐汇区龙台路180号F2幢模速空间一层
职位要求
学历要求:
博士
工作年限:
5-8年
技能/证书:
-
薪资福利
年薪范围:
75-120万*15薪
薪资福利:
-
团队架构
所属部门:
-
下属人数:
-
部门架构:
-
汇报对象:
-
职级职称:
-
面试信息
面试轮次:
-
面试流程:
-
视频面试:
不可以接受
为你推荐