职位编号 J20260921070615137052
算法工程师(Agent安全与对齐方向)(急)
50-100万北京市本科3-5年招聘 1 人预计佣金 116K1天前刷新/9月21日 07:17发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:加微信,进项目群拿手册:130/3315/1253
优先条件:加微信,进项目群拿手册:130/3315/1253
目标公司/行业:加微信,进项目群拿手册:130/3315/1253
必问问题:
待发单方补充
JD基本信息
岗位职责
负责 Agent 长程任务场景下的可靠执行模型训练与优化,包括监督微调、偏好对齐(DPO/RLHF 等)及 Agentic RL等;
研究长程、多智能体场景下的行为建模相关算法,包括轨迹数据建模、长上下文建模、行为评估与异常检测等;
探索模型训练与架构层面的改进,支撑多轮、长程等复杂场景下的能力扩展;
建设模型的评估体系与基准,包括检测效果、误报控制、泛化能力等维度,支撑模型的持续迭代与产品化落地。
任职要求
必备项
计算机、人工智能、信息安全、数学等相关专业,硕士及博士优先;
2–3 年 AI / Agent 安全、模型安全评测、大模型红队、自动化安全测试等任一方向的实战经验;(考虑博士应届生)
熟悉 LLM 训练全流程,有 CPT / SFT / Super Alignment / RLHF / DPO 中至少一种的实际项目经验,熟悉主流训练框架(DeepSpeed、Megatron、TRL 、veRL等);
扎实的工程能力:熟练使用 Python,能独立完成数据处理、训练 pipeline、评估脚本的开发;
具备创业心态:能在方向明确但路径未定的环境中自主拆解问题、快速验证、对结果负责。
加分项
有 Agentic RL、世界模型(World Model)、过程奖励模型(PRM)、可扩展监督(Scalable Oversight)相关研究或项目经验;
有检测引擎、运行时安全、沙箱、策略引擎、安全产品或 Agent 治理平台建设经验;
熟悉 Windows / Linux / Android 系统层安全数据采集(Sysmon / eBPF / 系统调用审计等);
在 AI 训练与对齐、系统安全等方向有顶会论文(NeurIPS / ICML / ICLR / USENIX Security / S&P / CCS 等)或开源项目贡献。
所属行业:人工智能/大模型/算力
职能分类:算法研究员
工作城市:
北京,招聘1人,详细地址:北京市西城区
职位要求
学历要求:本科·统招·985/211
工作年限:3-5年
薪资福利
年薪范围:50-100万 12薪
薪资福利:-
面试信息
面试轮次:0轮
视频面试:不可以接受
面试流程:-