职位编号 J20260827203155132115
视觉识别与AI应用工程师平台直营
20-40万唐山市本科3-5年招聘 1 人预计佣金 50.4K3天前刷新/8月27日 20:41发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:无
优先条件:无
目标公司/行业:无
必问问题:
待发单方补充
JD基本信息
岗位职责
核心定位
独立负责儿童乐园全部互动游戏项目的视觉识别工作,覆盖从摄像头选型、数据采集、标注、训练、边缘部署到上线优化的完整链路。视觉模块只负责输出结构化“事实”,不直接进行业务判断或控制机械设备。
岗位职责
数据侧:
1,负责摄像头选型、机位布置方案设计,解决透明材质反光、复杂光照、设备遮挡、多人入镜、儿童身高差异等问题;
2,制定数据采集方案,覆盖2—8岁儿童正常操作、动作过快、动作不到位、多次尝试、中途放弃、家长代做、多人干扰、遮挡等真实场景;
3,制定标签体系、标注规范及质量验收标准,完成目标框、关键点、动作起止时间、运动轨迹、设备状态、分割区域等标注统筹与验收。
模型侧:
1, 负责目标检测、图像分类、目标跟踪、人体姿态、手部识别、时序动作识别、语义分割、轨迹分析、密度估计等模型的选型、训练、验证与调优;
2,持续解决误识别、漏识别、场景泛化问题;
3,设计置信度阈值、多帧确认、异常重试和降级策略。
部署侧:
1, 将模型部署到房间服务器、Jetson、RK3588等边缘设备,完成模型转换、压缩、量化、推理优化;
2, 保证系统低延迟、稳定、离线运行。
融合与输出侧:
1, 设计视觉与按钮、流量、压力、电流、震动、转速等传感器数据的分工及融合方案;
2, 输出结构化“事实”:人员事实、设备/物体事实、动作事实、关系事实,供边缘规则库生成标准事件;
3, 不允许跳过规则库直接进行业务判断或控制设备。
语音与LLM侧:
1, 负责儿童语音识别、语音转写、声音事件识别模块的选型、测试和本地化部署;
2, 负责DeepSeek等大语言模型的下载、安装、本地化部署、API接入、参数配置和基础维护;
3, 可研究本地知识库、RAG等技术,用于游戏结束后的家长报告、儿童表现总结、个性化夸奖内容生成;
4, 严格界定LLM使用边界:现场实时识别和安全判断必须使用识别模型、传感器及固定规则,大模型不得直接生成现场控制规则或控制设备。
工具与文档侧:
1, 持续研究AI办公及AI开发工具,输出可执行的工具评估报告和标准化工作流程;
2, 输出摄像头布置图、数据采集方案、标注规范、训练数据集、模型安装包、部署说明、识别接口文档、测试报告、误识别/漏识别分析报告;
3, 与业务、后端、嵌入式、机械、电气等团队协作完成项目落地。
任职要求
学历:211及以上,计算机/AI/视觉/自动化/电子等相关专业,本科及以上
经验:3年以上CV算法研发,有“数据采集→标注→训练→部署→优化”完整项目闭环,非仅调API
技术:Python + PyTorch;熟悉YOLO等主流模型(检测/分类/跟踪/姿态/时序动作)
边缘部署:必须有Jetson/RK3588/GPU服务器部署经验,熟悉ONNX/TensorRT/RKNN/量化
独立能力:能独立设计摄像头布置、数据采集方案、标注规范、模型方案及验收标准
LLM:了解DeepSeek等本地部署或API接入,了解RAG
所属行业:计算机服务、智能硬件/消费电子
职能分类:全栈工程师
工作城市:
唐山,招聘1人,详细地址:河北省唐山市路北区龙富南道龙泉北里新景楼
职位要求
学历要求:本科·统招·985/211
工作年限:3-5年
薪资福利
年薪范围:20-40万 12薪
薪资福利:五险一金,免费提供食宿(早餐自理)
团队架构
所属部门:技术部
汇报对象:技术部负责人
下属人数:-
职级职称:-
部门架构:-
面试信息
面试轮次:2轮
视频面试:可以接受
面试流程:测评 → HR简历核实 → 老板面试2轮(含考题)( 终面线下)
终面线下面试报销交通