职位编号 J20260909113341134592
算法工程师(Agent安全与对齐方向)
70-120万北京市本科3-5年招聘 1 人预计佣金 130.6K14小时前刷新/9月14日 14:28发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:计算机/AI/信息安全/数学等专业,硕士及博士优先(博士应届可考虑);2-3年AI/Agent安全、模型安全评测、大模型红队、自动化安全测试任一方向实战经验;熟悉LLM训练全流程,有CPT/SFT/Super Alignment/RLHF/DPO至少一种实际项目经验,熟悉DeepSpeed/Megatron/TRL/veRL框架;Python扎实,能独立完成数据处理/训练pipeline/评估脚本;创业心态
优先条件:Agentic RL/世界模型/PRM/可扩展监督、检测引擎/运行时安全/沙箱/策略引擎、Sysmon/eBPF系统安全采集、顶会论文或开源贡献
目标公司/行业:AI互联网大厂,360,字节,腾讯,百度
必问问题:
待发单方补充
JD基本信息
岗位职责
岗位定位
你将参与公司智能体方向的核心模型算法研发,跟踪并消化大模型训练、Agent 安全、强化学习算法等前沿方向的工作,落到可训练、可评估、可上线的模型与系统中。这是一个研究型工程岗位:技术方向明确前沿,数据来自真实业务,具体路径由你和团队一起探索。
岗位职责
负责 Agent 长程任务场景下的可靠执行模型训练与优化,包括监督微调、偏好对齐(DPO/RLHF 等)及 Agentic RL等;
研究长程、多智能体场景下的行为建模相关算法,包括轨迹数据建模、长上下文建模、行为评估与异常检测等;
探索模型训练与架构层面的改进,支撑多轮、长程等复杂场景下的能力扩展;
建设模型的评估体系与基准,包括检测效果、误报控制、泛化能力等维度,支撑模型的持续迭代与产品化落地。
任职要求
任职要求
必备项
计算机、人工智能、信息安全、数学等相关专业,硕士及博士优先;
2–3 年 AI / Agent 安全、模型安全评测、大模型红队、自动化安全测试等任一方向的实战经验;(考虑博士应届生)
熟悉 LLM 训练全流程,有 CPT / SFT / Super Alignment / RLHF / DPO 中至少一种的实际项目经验,熟悉主流训练框架(DeepSpeed、Megatron、TRL 、veRL等);
扎实的工程能力:熟练使用 Python,能独立完成数据处理、训练 pipeline、评估脚本的开发;
具备创业心态:能在方向明确但路径未定的环境中自主拆解问题、快速验证、对结果负责。
所属行业:互联网、人工智能/大模型/算力、大数据
职能分类:大模型算法
工作城市:
北京,招聘1人,详细地址:北京
职位要求
学历要求:本科·统招·985/211
工作年限:3-5年
薪资福利
年薪范围:70-120万 15薪
薪资福利:open
面试信息
面试轮次:3轮
视频面试:可以接受
面试流程:-