职位编号 J20260921220055137450
大模型推理引擎工程师反馈快
50-90万北京市本科5-8年招聘 3 人预计佣金 74.3K1天前刷新/9月21日 22:12发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:1. 符合特定条件的学历可放宽至一本或List中的院校。
2. 不少于5年相关行业经验,经验在3年以上但不到5年的需个案分析技术深度和项目匹配度。
3. 跳槽频率10年内不能超过5次,11年及以上的不能超过6次。
4. 优先看40周岁以内的候选人,45周岁以上的不建议推荐。
5. 候选人需至少具备以下一类经验:
1)AI产品(AI应用、智能体或大模型等)经验。
2)AI算法经验。
3)智能座舱产品经验。
4)车端项目经验。
6. 不考虑无AI性质的软硬件开发经验或行业跨度较大的应聘者。
优先条件:请务必联系发单顾问加V获取实时信息更新并进行进度跟进!
目标公司/行业:以头部新势力车企和互联网AI公司为主,优先搜寻如下公司背景的候选人:理想汽车、小米汽车、蔚来汽车、字节跳动、百度和阿里巴巴等。
必问问题:
待发单方补充
JD基本信息
岗位职责
1. 负责排查推理过程中的稳定性故障、性能瓶颈、精度损耗等疑难问题。持续跟踪业界大模型底层前沿技术,调研显存压缩、新型并行策略、异构适配、推理加速等新技术,完成方案验证、落地与规模化复用。
2. 负责LLM / VLM大模型的部署和推理优化开发,包括算子优化,并行化等各种典型的优化工作,确保系统的高性能,高可用和低成本。
3. 与业务、产品、算法等团队合作,共同致力提升模型在业务场景的效果。
4. 探索一些前沿的推理加速技术,包括在新型GPU / NPU上的部署落地。
任职要求
1. 熟悉Transformers等主流模型原理。
2. 熟悉至少一种推理引擎框架(vLLM / SGlang / ONNX Runtime或其他自研框架)。
3. 了解GPU / NPU硬件特性,具备一定的性能调优经验。
4. 有以下至少一项的背景知识与经验:GPU编程、模型量化、Kernel开发及优化。
5. 成功落地过推测解码、PagedAttention、KV Cache优化等前沿技术,并在提升吞吐量或降低功耗方面有量化成果。
6. 良好的团队协作能力,有良好的动手实现能力,对技术有热情。
所属行业:人工智能/大模型/算力、汽车整车、汽车智能化&自动驾驶
职能分类:大模型算法
工作城市:
北京,招聘3人,详细地址:北京飞地项目位于融科资讯中心A座,具体地址咨询发单顾问。
职位要求
学历要求:本科·统招·985/211
工作年限:5-8年
薪资福利
年薪范围:50-90万 12薪
薪资福利:1. 工作经验5-10年:50-70w。
2. 工作经验11年及以上:60-90w。
3. 工作年限在3年以上但不满5年的需要个案评估,薪资40-60w/年。
缴纳北京的社保,请寻访北京地区的人选。
团队架构
所属部门:-
汇报对象:-
下属人数:-
职级职称:高级主管级
部门架构:-
面试信息
面试轮次:1轮
视频面试:不可以接受
面试流程:-