职位编号 J20260828155016132293
大模型接入与调度平台研发工程师
80-100万北京市本科3-5年招聘 1 人预计佣金 129.7K16小时前刷新/8月28日 16:08发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:职位要求
1. 具备扎实的后端研发能力,熟练掌握 Go、Java、Rust 等至少一种语言,有高并发服务、
API Gateway、反向代理或分布式系统研发经验。
2. 熟悉负载均衡、限流熔断、服务发现、缓存、消息队列及高可用架构;对长连接、SSE、
WebSocket、流式传输等机制有深入理解。
3. 了解主流大模型 API、模型调用协议及 Agent/Coding 工具链;有多模型接入、协议转
换、模型路由或 AI 基础设施相关经验者优先。
4. 具备较强的问题定位、系统设计和工程落地能力,能够独立推动复杂系统从方案设计到
生产运行;对大模型基础设施方向有长期兴趣。
优先条件:职位要求
1. 具备扎实的后端研发能力,熟练掌握 Go、Java、Rust 等至少一种语言,有高并发服务、
API Gateway、反向代理或分布式系统研发经验。
2. 熟悉负载均衡、限流熔断、服务发现、缓存、消息队列及高可用架构;对长连接、SSE、
WebSocket、流式传输等机制有深入理解。
3. 了解主流大模型 API、模型调用协议及 Agent/Coding 工具链;有多模型接入、协议转
换、模型路由或 AI 基础设施相关经验者优先。
4. 具备较强的问题定位、系统设计和工程落地能力,能够独立推动复杂系统从方案设计到
生产运行;对大模型基础设施方向有长期兴趣。
目标公司/行业:互联网大厂,私募量化
必问问题:
待发单方补充
JD基本信息
岗位职责
职位描述
1. 负责大模型统一服务网关的设计与研发,建设面向多模型统一接入、协议适配、鉴权及
流式通信能力,为公司内部 AI 应用和研发工具提供稳定、易用的模型基础设施。
2. 设计模型路由、负载均衡、并发控制、限流熔断及故障切换机制,持续提升大规模模型
调用场景下的性能、稳定性与资源利用效率。
3. 建设模型调用的成本治理体系,通过智能路由、缓存优化、流量调度和用量管控等手段,
在保障模型效果和用户体验的前提下降低整体调用成本。
4. 建立模型服务的可观测性与质量检测能力,围绕可用性、延迟、输出质量及服务一致性
持续优化,参与打造支撑前沿 Coding Agent 与 AI 产品的核心基础设施。
任职要求
职位要求
1. 具备扎实的后端研发能力,熟练掌握 Go、Java、Rust 等至少一种语言,有高并发服务、
API Gateway、反向代理或分布式系统研发经验。
2. 熟悉负载均衡、限流熔断、服务发现、缓存、消息队列及高可用架构;对长连接、SSE、
WebSocket、流式传输等机制有深入理解。
3. 了解主流大模型 API、模型调用协议及 Agent/Coding 工具链;有多模型接入、协议转
换、模型路由或 AI 基础设施相关经验者优先。
4. 具备较强的问题定位、系统设计和工程落地能力,能够独立推动复杂系统从方案设计到
生产运行;对大模型基础设施方向有长期兴趣。
所属行业:互联网、人工智能/大模型/算力
职能分类:全栈工程师
工作城市:
北京,招聘1人,详细地址:海淀
职位要求
学历要求:本科·985/211
工作年限:3-5年
薪资福利
年薪范围:80-100万 15薪
薪资福利:-
面试信息
面试轮次:3轮
视频面试:可以接受
面试流程:-