情报五站方法论(珍妮纺织机范式)
适用场景
- 营销片管线前置情报层:商品档案从零到装订(G1 确认门前置)
- 经营班组趋势/竞品/爆款/评论语义挖掘(范式泛化)
触发条件
- 营销片(
marketing-film)强制激活;纯故事/知识类的叙事片跳过情报层 - 档案命中且未过期(≤30 天)可复用;复用档案同样要过 G1 确认(确认"旧情报还能不能用")
- 检索通道全部不可用时返回缺站清单,不得用手写常识补位
决策原则(含阈值与失败关闭)
- 无源不入库:每条事实/观点必须挂证据编号;缺源即剔除并记入 gaps,禁止"先入库后补源"。(来源:KB:
vendor/supermickey/hyperreality-system/engines/data-mining-engine/SKILL.md§一·铁律 1) - 置信度三级不越级:confirmed(官方或 ≥2 独立来源)/ reported(单一来源)/ inferred(推理)。inferred 禁止进入事实区、核心卖点、事实红线字段与任何下游摘要卡。(同上·铁律 2)
- 独立来源按域名去重:同一稿件的多平台转载只算 1 个来源,防止"一贴十转 = 十源"把 reported 抬成 confirmed。(同上 §四·A4 法尺 1)
- 冲突不仲裁:价格样本离散度 >30% 记 conflict,官方渠道优先;无官方来源降级 reported 并标浮动区间;禁止把冲突价格折中成一个数。(同上 §四·A4 法尺 2)
- 缺站显式:A1(身份事实)缺失 → 全线停摆(
ok:false);A2/A3 缺站 → 记 gap 继续装订,档案上必须可见缺口。(同上 §七·故障与降级) - 装订失败即拒收:A5 Schema 强校验不过 → 抛错拒收(宁缺毋滥),由主链路按"无档案"继续,不得降级为弱档案。(同上 §一·铁律 4)
- 商品图只认真实来源:AI 生成图/概念图/渲染图直接出局(评分 −100);有效图 <2 张打
needs_more_reference。(同上 §四·A1 蒸馏)
打法库(场景 → 动作序列 → 判据)
- 主线(实物商品 · 采集 8 路):官网/旗舰店商品页 → 参数规格 → 全价格样本 → 官方产品图 → 实拍开箱 → 白底图 → 型号甄别 → 授权风险分级。判据:事实区条目 100% 挂证据编号;有效图 ≥2 张且英雄照编号
{品牌}-HERO-001在位。 - 分支 1(服务类商品 · 采集 6 路):资质 → 预约/接待链路 → 履约与交付边界 → 价格构成 → 退款与改期规则 → 真实体验评价。判据:使用前提与依赖条件写成可核实条目(无资质/无固定门店必须明写,不得含糊)。
- 分支 2(样本不足或全好评):清洗后有效评价 <10 条,或 ≥3 条且差评 0 条 → 只输出「样本不足」/「偏倚警报」,禁止产出趋势结论与卖点排序。判据:报告中出现
sample_insufficient或bias_alarm标记。 - 分支 3(型号易混):同系列旧款、仿品、套装混入 → 追加"型号甄别"定向查询后重排。判据:每条规格带
source_url,型号字符串与目标型号逐字符一致。
SOP(每步带触发/回执/失败路径)
- 触发:任务进入营销片管线或调研类工种接单 → 动作:生成查询矩阵(实物 8 路 / 服务 6 路)与回填格式 → 回执:任务书(矩阵 + 格式 + 目标样本量)→ 失败:检索通道全挂 → 返回缺站清单,禁止编造。
- 触发:采集回填完成 → 动作:清洗(水军出局 / 40 字指纹去重 / <4 字无效出局)→ 回执:清洗量与剔除原因统计 → 失败:清洗后 <10 条 → 走分支 2。
- 触发:条目进入核验 → 动作:域名去重定级 + 价格离散度计算 + 无源清洗(记录 purged)→ 回执:
verification_report→ 失败:冲突无法裁决时保留双方并标 conflict。 - 触发:Schema 校验通过 → 动作:生成六张摘要卡 + 落盘
data/dossiers/{product_id}/+ 索引登记 → 回执:dossier.json/images/manifest.json/ 摘要卡 → 失败:校验失败抛错拒收。 - 触发:档案准备注入下游 → 动作:走 G1 人工确认门(含复用档案)→ 回执:确认单 + 裁决 → 失败:驳回即整体退出情报层,主流程无情报继续(不阻塞、不伪造)。
关键指标(含基准与护栏)
| 指标 | 基准/参考值 | 阈值/护栏 | 来源 |
|---|---|---|---|
| 评价样本量 | ≥10 条 | <10 条只报样本不足,不出趋势 | KB:data-mining §四·A2 |
| 差评/中评占比 | ≥15% | 清洗后 ≥3 条且零差评 → 强制记 gap | KB:data-mining §四·A2 |
| 原话矿 | 前 12 条(8–80 字,按情绪浓度排序) | 不足 12 条按实际条数并标注 | KB:data-mining §四·A2 |
| 价格离散度 | ≤30% | >30% 记 conflict,下游必须标浮动 | KB:data-mining §四·A4 |
| 竞品数量 | ≤3(同品类且价格带重叠) | 超限裁剪;每条至少 1 条带来源卖点才准入列 | KB:data-mining §四·A3 |
| 有效商品图 | ≥2 张 | <2 张打 needs_more_reference | KB:data-mining §四·A1 |
| 档案新鲜度 | 30 天 | 过期 → stale:true,由调用方决定沿用或重跑 | KB:data-mining §四·A5 |
失败模式(症状 → 检测器 → 处置)
| 症状 | 检测器 | 处置 |
|---|---|---|
条目无 source_url 也进了档案 | L2 纪律硬校验(HandoffValidator) | 整条剔除 + 记 gap,不得回填编造来源 |
| "提及次数"被当成"来源数"→ 置信度虚高 | 域名去重计数 | 降级 reported,重算定级 |
| 评价全好评、无差评 | 偏倚警报(清洗后 ≥3 条且差评 0) | 强制记 gap,注明样本偏倚 |
| 竞品 >3 个或含非直接竞品 | 相关性排序(品类贴合 +2 / 价格中点差 ≤30% +3) | 裁剪到 ≤3,其余转"泛竞品观察"不入档 |
| 冲突价格被平均成一个数 | 价格离散度 >30% 检查 | 恢复 min-max 区间并标 conflict |
| 复用过期档案无提示 | stale 标记 | 返回 stale:true,禁止静默复用 |
输出契约
- 每次产出:档案条目 + 来源 URL/平台 + 抓取时间 + 置信度标签 + 证据链(memory_refs)。
- 样本不足 10 条只报「样本不足」,不产出趋势结论。
- 无工具回执的关键数字标「未核实」,不得宣称完成(L3.6/E3.7)。
边界
- 不做创意、不做卖点排序(排序属创意策划;本技能只交付证据与分区)。
- 不改写用户原话;聚合只做归类不做润色。
- 不做商品图合成与美化(图只作定妆照参考,授权风险只标记不拦截)。