**********************
视觉识别与AI应用工程师
  • 收藏职位
  • 分享职位
20-40万 唐山 本科 3-5年 招聘 1 人 预计佣金 50.4K 1天前刷新/2天前发布
迅致直营 72小时新发
JD基本信息
岗位职责
核心定位 独立负责儿童乐园全部互动游戏项目的视觉识别工作,覆盖从摄像头选型、数据采集、标注、训练、边缘部署到上线优化的完整链路。视觉模块只负责输出结构化“事实”,不直接进行业务判断或控制机械设备。 岗位职责 数据侧: 1,负责摄像头选型、机位布置方案设计,解决透明材质反光、复杂光照、设备遮挡、多人入镜、儿童身高差异等问题; 2,制定数据采集方案,覆盖2—8岁儿童正常操作、动作过快、动作不到位、多次尝试、中途放弃、家长代做、多人干扰、遮挡等真实场景; 3,制定标签体系、标注规范及质量验收标准,完成目标框、关键点、动作起止时间、运动轨迹、设备状态、分割区域等标注统筹与验收。 模型侧: 1, 负责目标检测、图像分类、目标跟踪、人体姿态、手部识别、时序动作识别、语义分割、轨迹分析、密度估计等模型的选型、训练、验证与调优; 2,持续解决误识别、漏识别、场景泛化问题; 3,设计置信度阈值、多帧确认、异常重试和降级策略。 部署侧: 1, 将模型部署到房间服务器、Jetson、RK3588等边缘设备,完成模型转换、压缩、量化、推理优化; 2, 保证系统低延迟、稳定、离线运行。 融合与输出侧: 1, 设计视觉与按钮、流量、压力、电流、震动、转速等传感器数据的分工及融合方案; 2, 输出结构化“事实”:人员事实、设备/物体事实、动作事实、关系事实,供边缘规则库生成标准事件; 3, 不允许跳过规则库直接进行业务判断或控制设备。 语音与LLM侧: 1, 负责儿童语音识别、语音转写、声音事件识别模块的选型、测试和本地化部署; 2, 负责DeepSeek等大语言模型的下载、安装、本地化部署、API接入、参数配置和基础维护; 3, 可研究本地知识库、RAG等技术,用于游戏结束后的家长报告、儿童表现总结、个性化夸奖内容生成; 4, 严格界定LLM使用边界:现场实时识别和安全判断必须使用识别模型、传感器及固定规则,大模型不得直接生成现场控制规则或控制设备。 工具与文档侧: 1, 持续研究AI办公及AI开发工具,输出可执行的工具评估报告和标准化工作流程; 2, 输出摄像头布置图、数据采集方案、标注规范、训练数据集、模型安装包、部署说明、识别接口文档、测试报告、误识别/漏识别分析报告; 3, 与业务、后端、嵌入式、机械、电气等团队协作完成项目落地。
任职要求
学历:211及以上,计算机/AI/视觉/自动化/电子等相关专业,本科及以上 经验:3年以上CV算法研发,有“数据采集→标注→训练→部署→优化”完整项目闭环,非仅调API 技术:Python + PyTorch;熟悉YOLO等主流模型(检测/分类/跟踪/姿态/时序动作) 边缘部署:必须有Jetson/RK3588/GPU服务器部署经验,熟悉ONNX/TensorRT/RKNN/量化 独立能力:能独立设计摄像头布置、数据采集方案、标注规范、模型方案及验收标准 LLM:了解DeepSeek等本地部署或API接入,了解RAG
所属行业:
计算机服务、智能硬件/消费电子
职能分类:
全栈工程师
工作城市:
唐山,招聘1人,详细地址:河北省唐山市路北区龙富南道龙泉北里新景楼
职位要求
学历要求:
本科·统招·985/211
工作年限:
3-5年
技能/证书:
-
薪资福利
年薪范围:
20-40万*12薪
薪资福利:
五险一金,免费提供食宿(早餐自理)
团队架构
所属部门:
技术部
下属人数:
-
部门架构:
-
汇报对象:
技术部负责人
职级职称:
-
面试信息
面试轮次:
2轮
面试流程:
测评 → HR简历核实 → 老板面试2轮(含考题)( 终面线下) 终面线下面试报销交通
视频面试:
可以接受
为你推荐