**********************
大模型接入与调度平台研发工程师
  • 收藏职位
  • 分享职位
80-100万 北京 本科 3-5年 招聘 1 人 预计佣金 129.7K 1天前发布
72小时新发
JD基本信息
岗位职责
职位描述 1. 负责大模型统一服务网关的设计与研发,建设面向多模型统一接入、协议适配、鉴权及 流式通信能力,为公司内部 AI 应用和研发工具提供稳定、易用的模型基础设施。 2. 设计模型路由、负载均衡、并发控制、限流熔断及故障切换机制,持续提升大规模模型 调用场景下的性能、稳定性与资源利用效率。 3. 建设模型调用的成本治理体系,通过智能路由、缓存优化、流量调度和用量管控等手段, 在保障模型效果和用户体验的前提下降低整体调用成本。 4. 建立模型服务的可观测性与质量检测能力,围绕可用性、延迟、输出质量及服务一致性 持续优化,参与打造支撑前沿 Coding Agent 与 AI 产品的核心基础设施。
任职要求
职位要求 1. 具备扎实的后端研发能力,熟练掌握 Go、Java、Rust 等至少一种语言,有高并发服务、 API Gateway、反向代理或分布式系统研发经验。 2. 熟悉负载均衡、限流熔断、服务发现、缓存、消息队列及高可用架构;对长连接、SSE、 WebSocket、流式传输等机制有深入理解。 3. 了解主流大模型 API、模型调用协议及 Agent/Coding 工具链;有多模型接入、协议转 换、模型路由或 AI 基础设施相关经验者优先。 4. 具备较强的问题定位、系统设计和工程落地能力,能够独立推动复杂系统从方案设计到 生产运行;对大模型基础设施方向有长期兴趣。
所属行业:
互联网、人工智能/大模型/算力
职能分类:
全栈工程师
工作城市:
北京,招聘1人,详细地址:海淀
职位要求
学历要求:
本科·985/211
工作年限:
3-5年
技能/证书:
-
薪资福利
年薪范围:
80-100万*15薪
薪资福利:
-
团队架构
所属部门:
-
下属人数:
-
部门架构:
-
汇报对象:
-
职级职称:
-
面试信息
面试轮次:
3轮
面试流程:
-
视频面试:
可以接受
为你推荐