职位编号 J20260708181703121119
(VLA方向)物理AI基础大模型算法工程师平台直营反馈快
50-100万上海市广州市研究生0-3年招聘 2 人预计佣金 100.8K21小时前刷新/7月9日 13:22发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:加微信拿项目手册
优先条件:寻访方向:
1、优先具身、机器人等行业背景,自动驾驶次之;
2、聚焦机械臂和物理因果模型,不看重腿部算法;
3、岗位工作年限在1-3年以内,>3年的具体情况具体对待;
目标公司/行业:对标公司名单:极佳视界、简智新创(北京)机器人科技有限公司、诺亦腾、Manifold AI (流形空间)、章鱼动力 (SynapX)、逆矩阵 (Physis)、星源智、光轮智能、索辰科技、智元机器人、银河通用机器人、宇树机器人、普渡机器人
必问问题:
- 目前薪资、期望薪资、离职原因(如果最近两段跳槽频繁,需要补充最近两段的离职原因)
JD基本信息
岗位职责
1、在物理AI基础大模型的统一架构(unified model)下,负责 VLA / Policy 模块的架构设计、训练与部署,覆盖视觉编码、语言条件、动作生成的完整链路
2、设计能跨任务、跨 embodiment 泛化的 VLA 模型,参考业界主流路线(PI0、RDT、OpenVLA、GROOT、Qwen-VLA 等),在视觉编码、动作头、语言条件等关键设计点上做工程选型与改进
3、负责大规模分布式训练(多机多卡),设计 SFT + RL 的完整 post-training pipeline,研究并实现具身 RL 算法(GRPO、DAPO、Flow Matching RL 等),处理 reward sparsity、长 horizon 训练稳定性等核心问题
4、设计跨 embodiment 的统一动作表征与适配方案,支持机械臂、人形、灵巧手、移动底盘等不同形态的快速接入,覆盖动作空间异构、控制频率差异、少样本适配等问题
推动推理加速与真机部署:将 VLA 模型压缩到边缘硬件可跑、端到端延迟 <200ms,涉及量化、KV cache 优化、action chunking、推理引擎对接等工作
5、建立"训练→真机部署→收集 badcase→重训"的闭环迭代机制,解决真机部署中的泛化与稳定性问题
任职要求
1、计算机、人工智能、机器人或相关专业,硕士及以上学历
2、精通 Python 和 PyTorch,有大规模分布式训练经验(DeepSpeed / Megatron / FSDP 等至少一种)
3、对 VLA / VLM 架构(PI0、OpenVLA、RDT、GROOT、Qwen-VLA 等)有深入理解,能讲清楚视觉编码、动作头设计、语言条件注入等关键选型的 trade-off
4、有 RL(PPO / GRPO / DAPO)或 IL(BC / Diffusion Policy)在仿真或真机环境中的完整训练经验
5、熟悉模型推理优化(量化、剪枝、TensorRT / vLLM)或 CUDA 算子开发
6、能独立阅读并复现 VLA / RL 领域的顶会论文
加分项:
1、有 VLA 模型从训练到真机部署的完整经验,理解仿真表现好、真机失效的常见原因
2、对 unified model 范式(如 Transfusion、Show-o、Janus-Pro、Cosmos、RynnVLA 等 AR + Generation 统一架构)有理解或实践经验
3、有 RLHF / DPO / Flow Matching RL 或机器人专用 RL 算法的实战经验
4、有真实机器人(机械臂、人形、灵巧手、移动机器人)的部署经验,熟悉 ROS / ROS2、机器人运动学/动力学
5、在 NeurIPS / ICML / ICLR / CoRL / RSS / ICRA 等顶会发表过相关论文
所属行业:人工智能/大模型/算力
职能分类:算法研究员
工作城市:
上海,招聘1人,详细地址:上海市徐汇区凯科国际大厦广州,招聘1人,详细地址:广州市海珠区广州国际生物岛螺旋大道与月湾一路交汇处合景科盛广场17楼
职位要求
学历要求:研究生
工作年限:0-3年
薪资福利
年薪范围:50-100万 15薪
薪资福利:-
面试信息
面试轮次:4轮
视频面试:可以接受
面试流程:-