**********************
强化学习算法工程师
  • 收藏职位
  • 分享职位
60-105万 北京 研究生 0-3年 招聘 1 人 预计佣金 114.2K 15:15刷新/1天前发布
反馈快 72小时新发
JD基本信息
岗位职责
职位描述 1. 算法研究与开发; 2. 深入研究强化学习领域的前沿算法(PPO、GRPO等)并应用于大模型领域; 3. 优化强化学习训练框架,提升训练速度与稳定性; 4. 大规模应用强化学习,以提升模型模型长思考能力、通用能力、Agent能力等。
任职要求
职位要求 1. 计算机科学、人工智能、机器学习、数学、统计学或相关领域的硕士及以上学历; 2. 熟练掌握强化学习经典算法(如PPO、GRPO等),并具备实际项目经验 3. 紧跟学术前沿,积极探索前沿算法,针对实际项目中的问题优化算法 4. 熟悉深度学习框架(如TensorFlow、PyTorch)和强化学习训练框架(如verl、openrlhf、trl、nemo-aligner等) 5. 了解大规模分布式模型训练(如deepspeed、FSDP、megatron等) 6. 具备扎实的编程能力,熟练使用Python,熟悉常用数据结构和算法 7. 具备较强的学习能力和解决问题的能力,能够快速学习新技术,基础扎实,动手能力强。 面壁智能的岗位
所属行业:
人工智能/大模型/算力
职能分类:
算法工程师
工作城市:
北京,招聘1人,详细地址:北京市海淀区清华科技园科建大厦3层
职位要求
学历要求:
研究生
工作年限:
0-3年
技能/证书:
-
薪资福利
年薪范围:
60-105万*15薪
薪资福利:
-
团队架构
所属部门:
-
下属人数:
-
部门架构:
-
汇报对象:
-
职级职称:
-
面试信息
面试轮次:
-
面试流程:
-
视频面试:
不可以接受