企业招聘
职位
关于禾蛙
合伙人计划
联系客服快速发单
扫码添加企业微信
客服电话
400-7777-5125
猎企入驻
400-777-5125
免费注册
登录
**********************
算法工程师(视觉)
接单
收藏职位
分享职位
50-100万
北京
研究生
3-5年
招聘 1 人
预计佣金
100.8K
1天前发布
迅致直营
72小时新发
JD基本信息
岗位职责
1. 多模态大模型训练框架开发与优化 - 负责视觉-语言多模态大模型(如多模态LLM)训练框架的设计、开发与持续优化,覆盖预训练、指令微调(SFT)、后训练(DPO/PPO/GRPO等)等全流程。 - 研发高效的分布式训练策略,包括但不限于数据并行(DP)、张量并行(TP)、流水线并行(PP)、序列并行(SP)及混合并行方案,提升大规模集群的训练吞吐与线性度。 - 针对多模态数据的异构特性(图像、视频、文本等),设计高效的数据加载、预处理与混合精度训练流水线,降低IO瓶颈与显存开销。 - 研究并落地长上下文训练优化方案(如Ring Attention、Sequence Parallelism、Context Parallelism等),突破显存与通信瓶颈,支持百万级Token长序列高效训练。 2. 推理框架与部署优化 - 负责多模态大模型推理框架的架构设计与性能优化,包括KV Cache优化、连续批处理(Continuous Batching)、投机解码(Speculative Decoding)等核心技术的落地。 - 研究并落地长上下文推理优化方案(如KV Cache分页管理、Prefix Caching、分层注意力等),支持长视频、多图等长序列场景下的高效推理。 - 针对GPU/昇腾NPU等异构硬件进行算子级与系统级优化,充分利用硬件特性(如Tensor Core、FlashAttention、融合算子等)降低推理延迟、提升吞吐。 - 推动模型从训练到推理的端到端交付链路建设,实现训练产物到在线服务的高效转换与一键部署。 3. 视觉编码器与多模态对齐算法工程化 - 负责视觉编码器(ViT等)与语言模型的高效融合方案开发,优化跨模态对齐训练中的显存占用与通信开销。 - 研究并落地视觉Token压缩、动态分辨率、多图像/视频输入等前沿多模态架构改进的工程化实现。 - 探索并落地多模态全能模型(Omni Model)的训推框架适配,支持图文音视频等多模态统一理解与生成的端到端训练与推理。 4. 训推一体基础设施建设 - 构建训练-推理一体化平台能力,统一模型格式、Checkpoint管理与版本追踪,打通模型研发全生命周期。 - 开发自动化性能评测与回归基准(Benchmark),持续监控训练收敛速度、推理QPS、首字延迟(TTFT)等核心指标。 - 建设故障容忍与弹性恢复机制,保障千卡/万卡级别长时训练任务的稳定性。 5. 前沿技术追踪与团队协作 - 持续追踪大模型训练与推理领域的最新学术成果与开源项目(如DeepSpeed、Megatron-LM、vLLM、veRL等),评估并引入适用技术。 - 与算法研究团队紧密协作,将前沿算法快速工程化落地,缩短从研究到生产的转化周期。 - 参与技术文档撰写、技术分享与Code Review,提升团队整体工程水平。
任职要求
1. 学历专业:硕士及以上学历,计算机科学、人工智能、电子信息、数学等相关专业。 2. 工作经验:3年以上深度学习系统或算法工程相关工作经验,有大模型训练或推理框架开发经验者优先。 3. 编程能力: - 精通Python,具备扎实的工程代码能力,熟悉类型注解、异步编程、性能调优等。 - 熟练掌握C/C++或CUDA,能进行算子级性能优化。 4. 深度学习框架: - 深入理解PyTorch核心机制(自动微分、分布式通信、自定义算子等)。 - 熟悉至少一种分布式训练框架(DeepSpeed / Megatron-LM / FSDP等),了解Ray、veRL等后训练框架者优先。 5. 大模型技术: - 熟悉Transformer架构原理及其变体,理解大模型训练与推理的关键技术挑战。 - 了解多模态模型(如Qwen-VL、DeepSeek-VL系列等)的架构设计与训练流程,了解多模态全能模型(Omni Model)者优先。 6. 系统与性能优化: - 熟悉GPU并行计算原理,有CUDA编程或Triton算子开发经验;有昇腾CANN开发经验者优先。 - 了解NCCL/Hccl等通信库,有大规模分布式训练集群调试与优化经验者优先。 7. 工程素养: - 熟悉Linux开发环境,熟练使用Git、Docker等工具。 - 具备良好的系统设计能力,能独立完成模块设计与技术方案文档撰写。 【加分项】 1. 在NeurIPS、ICML、ICLR、CVPR、ACL等顶会发表过大模型或系统优化相关论文。 2. 在主流开源项目(PyTorch、DeepSpeed、Megatron-LM、vLLM等)有重要贡献(PR merged)。 3. 有千卡以上规模大模型训练集群的工程实践。 4. 有视觉编码器(ViT等)或多模态模型训练框架的开发与优化经验。 5. 有昇腾算力集群训练或推理适配经验者优先。 6. 有长上下文大模型训练或推理优化经验者优先
所属行业:
通信/网络设备
职能分类:
算法工程师
工作城市:
北京,招聘1人,详细地址:北京-昌平区
职位要求
学历要求:
研究生·统招·985/211
工作年限:
3-5年
技能/证书:
-
薪资福利
年薪范围:
50-100万*15薪
薪资福利:
五险一金、超多福利
团队架构
所属部门:
-
下属人数:
-
部门架构:
-
汇报对象:
-
职级职称:
-
面试信息
面试轮次:
2轮
面试流程:
-
视频面试:
可以接受
举报
为你推荐
职能类别
IT互联网技术
电子/通信/半导体
销售/客服
制药/医疗器械/医疗护理
高级管理
关于
禾蛙动态
合伙人计划
猎企入驻
帮助中心
禾蛙协议
禾蛙海外版
联系我们
电话:400-777-5125(服务时间:工作日9:00至18:00)
网址:www.hewa.cn
地址:中国(上海)自由贸易试验区滨江大道99弄6号第11层
服务支持
接单方小程序
发单方小程序
微信公众号
©版权所有
上海禾蛙科技有限公司
沪公网安备31011502406070号
备案号:沪ICP备2026021218号-7
|
营业执照
|
服务许可证