媒资索引(media-indexing)
1. 索引结构(一个镜头一条)
| 字段组 | 内容 | 检索用途 |
|---|---|---|
| 身份 | shotId / 源 sha256 / 帧级区间 | 精确定位与复用回执 |
| 视觉标签 | 主体 / 场景 / 景别 / 运镜 / 光线 / 时段 / 天气 | "找一条黄昏的海边空镜" |
| 实体 | 人物 / 物件 / 地点 / 品牌 / 数据点 | 事实核对与品牌口径 |
| 情绪 | 主导情绪 / 强度 / 效价 | 情绪曲线选镜 |
| 技术 | 清晰度 / 曝光 / 稳定性 / 噪声 / 色彩 | 质量门槛 |
| 可用性 | usable / 授权状态 / 用途 | 进片前置 |
| 复用建议 | 适合当开头钩子/情绪点/转场/背景/结尾 + 已用片单回链 | 防止同一镜头被反复用 |
2. 检索口径(给下游的"先问库"纪律)
- 剪辑脚本选镜时,先按语义标签 + 情绪 + 时长带检索库内已有镜头,命中即复用(免重剪、免重渲)。
- 检索无命中且素材缺口无法用现有素材替代时,才提出补拍/补料需求(给规格:景别/时长/情绪/必须元素)。
- 复用必须留回执:
sourceShotId+usedIn(片名/项目)+usedAt;同一镜头在相近位置重复使用要显式说明理由。
3. 标签纪律
- 标签来自解析结论,不来自文件名臆测;没有把握的标签宁可不加。
- 一对多的实体(如"某品牌门店")拆成"品牌"与"场景:门店"两个标签,便于分别检索。
- 情绪标签只保留画面可见证据支持的(表情/姿态/环境),避免"治愈""高级感"这类无证据标签。
工艺判据(条件 → 做法 → 判据 → 来源)
| 条件 | 做法 | 判据 | 来源 |
|---|---|---|---|
| 镜头理解完成 | 生成索引条目(身份/标签/实体/情绪/技术/可用性) | 条目字段完整率 100% | 契约字段清单 |
| 同一内容重复上传 | sha256 命中即复用既有资产 | 不产生第二条记录 | 内容指纹 |
| 标签把握不足 | 不加该标签(宁缺不编) | 抽查标签成立率 ≥95% | 人工抽检 |
| 情绪标签 | 仅在有可见证据(表情/姿态/环境)时打标 | 无证据标签数 = 0 | 镜头理解结论 |
| 复用选择 | 先按语义+情绪+时长带检索库内素材 | 命中即复用,免重剪 | 检索记录 |
失败模式(症状 → 检测器 → 处置)
| 症状 | 检测器 | 处置 |
|---|---|---|
| 同一素材两条记录 | sha256 计算口径不一致 | 统一整文件 sha256;按内容去重并合并标签 |
| 检索不到本该存在的镜头 | 标签缺失或实体未登记 | 回查镜头理解产物;补标签后重建该条索引 |
| 标签与画面不符 | 抽检不通过 | 该批索引整体重跑,定位是解析问题还是映射问题 |
| 同一镜头被反复复用 | 复用回执缺失 | 补写 usedIn/usedAt 回链;相近位置重复使用需说明理由 |
5. 索引质量抽检(每批 10%)
- 随机抽 10% 镜头,人工核对 3 项:视觉标签是否成立、实体是否真实出现、可用性是否与授权一致。
- 抽检不合格率 >10% → 该批索引整体重跑(定位到是解析问题还是索引映射问题)。