**********************
算法工程师(Agent安全与对齐方向)
  • 收藏职位
  • 分享职位
70-120万 北京 本科 3-5年 招聘 1 人 预计佣金 130.6K 10:42刷新/1天前发布
72小时新发
JD基本信息
岗位职责
岗位定位 你将参与公司智能体方向的核心模型算法研发,跟踪并消化大模型训练、Agent 安全、强化学习算法等前沿方向的工作,落到可训练、可评估、可上线的模型与系统中。这是一个研究型工程岗位:技术方向明确前沿,数据来自真实业务,具体路径由你和团队一起探索。 岗位职责 负责 Agent 长程任务场景下的可靠执行模型训练与优化,包括监督微调、偏好对齐(DPO/RLHF 等)及 Agentic RL等; 研究长程、多智能体场景下的行为建模相关算法,包括轨迹数据建模、长上下文建模、行为评估与异常检测等; 探索模型训练与架构层面的改进,支撑多轮、长程等复杂场景下的能力扩展; 建设模型的评估体系与基准,包括检测效果、误报控制、泛化能力等维度,支撑模型的持续迭代与产品化落地。
任职要求
任职要求 必备项 计算机、人工智能、信息安全、数学等相关专业,硕士及博士优先; 2–3 年 AI / Agent 安全、模型安全评测、大模型红队、自动化安全测试等任一方向的实战经验;(考虑博士应届生) 熟悉 LLM 训练全流程,有 CPT / SFT / Super Alignment / RLHF / DPO 中至少一种的实际项目经验,熟悉主流训练框架(DeepSpeed、Megatron、TRL 、veRL等); 扎实的工程能力:熟练使用 Python,能独立完成数据处理、训练 pipeline、评估脚本的开发; 具备创业心态:能在方向明确但路径未定的环境中自主拆解问题、快速验证、对结果负责。
所属行业:
互联网、人工智能/大模型/算力、大数据
职能分类:
大模型算法
工作城市:
北京,招聘1人,详细地址:北京
职位要求
学历要求:
本科·统招·985/211
工作年限:
3-5年
技能/证书:
-
薪资福利
年薪范围:
70-120万*15薪
薪资福利:
open
团队架构
所属部门:
-
下属人数:
-
部门架构:
-
汇报对象:
-
职级职称:
-
面试信息
面试轮次:
3轮
面试流程:
-
视频面试:
可以接受
为你推荐