**********************
世界模型数据专家 / 负责人
  • 收藏职位
  • 分享职位
30-60万 北京 本科 0-3年 招聘 1 人 预计佣金 65.3K 15:15刷新/1天前发布
反馈快 72小时新发
JD基本信息
岗位职责
1. 负责世界模型训练数据体系建设,规划并落地世界模型所需的视频/多模态数据体系,包括数据来源、数据结构、清洗标准、标注规范、质量评估和版本管理。 2. 主导训练数据 sourcing,建立高质量视频数据获取策略,覆盖公开视频、版权数据、合作数据、合成数据、具身采集数据等来源,判断不同来源数据对世界模型训练的价值、成本和风险。 3. 设计数据清洗与过滤链路,负责视频数据的全链路处理方案,包括去重、切分、画质筛选、镜头/运动分析、字幕/OCR/水印过滤、真实度筛选、物理合理性过滤、低质样本剔除等。 4. 设计标注体系与数据语义结构,建立适合世界模型训练的标注规范,包括视频 caption、时间戳描述、动作与状态变化、物体关系、场景变化、因果事件、失败/异常行为等。 5. 建立数据-模型反馈闭环,与训练、评测团队紧密协作,通过消融实验、数据配比实验和模型表现分析,持续优化数据质量、数据分布和训练 curriculum。 6. 探索面向真实物理世界的数据策略,针对世界模型对真实物理规律、动作连续性、状态变化和时序因果的要求,设计区别于传统视频生成模型的数据筛选和处理方法。
任职要求
1. 有视频生成模型数据经验,优先考虑在一线视频生成模型团队中深度参与过训练数据建设的候选人,包括但不限于 Wan、Seedance、可灵、海螺、Longcat-Video、HunyuanVideo、爱诗、生数科技等相关团队。 2. 理解视频生成数据全链路,熟悉视频训练数据从 sourcing、下载、清洗、切分、过滤、标注、配比到版本管理的完整流程,并理解每个环节背后的目标和取舍。 3. 熟悉数据清洗与标注算子,对常见视频数据处理算子有实践经验,如去重、质量评分、运动强度分析、镜头切分、OCR/字幕/水印检测、美学评分、caption 生成与校验、多模态过滤等。 4. 具备数据驱动的模型迭代意识,能根据训练效果、评测结果和失败案例反推数据问题,设计数据消融实验,推动数据策略持续迭代。 5. 有强 ownership 和跨团队协作能力,能在开放问题中定义目标、拆解任务、推动落地,并与算法、工程、标注、采集和业务团队高效协作。 面壁智能的岗
所属行业:
人工智能/大模型/算力
职能分类:
数据架构师
工作城市:
北京,招聘1人,详细地址:北京市海淀区清华科技园科建大厦3层
职位要求
学历要求:
本科·统招
工作年限:
0-3年
技能/证书:
-
薪资福利
年薪范围:
30-60万*15薪
薪资福利:
-
团队架构
所属部门:
-
下属人数:
-
部门架构:
-
汇报对象:
-
职级职称:
-
面试信息
面试轮次:
-
面试流程:
-
视频面试:
不可以接受