职位编号 J20260921093123137065
大模型高性能算子研发工程师-至知创新研究院
100-300万北京市上海市本科3-5年招聘 2 人预计佣金 361.9K19小时前刷新/9月21日 21:53发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:保密招聘,加微信,进项目群拿手册:130/3315/1253
优先条件:保密招聘,加微信,进项目群拿手册:130/3315/1253
目标公司/行业:保密招聘,加微信,进项目群拿手册:130/3315/1253
必问问题:
待发单方补充
JD基本信息
岗位职责
职位描述
1、底层算子研发与极致优化:深度参与大模型推理框架核心Kernel的开发,与算法团队紧密协作进行算法设计到落地全链路的调优,探索并突破算子性能极限;
2、硬件级性能压榨:深入洞察硬件架构特性,针对不同计算与访存场景进行极致的算子性能调优,大幅提升模型推理的MFU与MBU。
任职要求
职位要求
1、具备扎实的C++/Python基础,精通CUDA、CUTLASS等高性能开发语言及库;
2、熟悉Triton、TileLang、Cutile-python 等现代AI编译器与前沿工具链;
3、深入理解Flash Attention及其衍生技术的工作原理与主流优化方法;
4、具备过硬的计算机体系结构功底,深刻理解现代芯片(如主流 GPU)的计算流水线与存储层级架构。
加分项:
1、熟悉主流大语言模型的底层网络架构;
2、在FuseMoE、Ragged Flash Attention、Ring Attention等前沿高效算子优化方面有实际开发经验或深入研究探索;
3、参与过千亿/万亿级开源大模型或主流高性能推理引擎(如SGLang、vLLM、ensorRT-LLM)底层性能优化经验者优先。
所属行业:互联网
职能分类:C/C++
工作城市:
北京,招聘1人,详细地址:北京上海,招聘1人,详细地址:上海
职位要求
学历要求:本科·统招·985/211
工作年限:3-5年
薪资福利
年薪范围:100-300万 15薪
薪资福利:-
面试信息
面试轮次:0轮
视频面试:不可以接受
面试流程:-