创意发散(creative-ideation v2)
1. 为什么升级
创作前提(先读):
docs/video-edit-creation-doctrine.md——素材是命题、剪辑是解题;三条创作纪律(先立意后结构 / 每段只服务一个情绪动词 / 把情绪落到物证上)。本技能负责"命题 → 七个解题方向"这一段。
旧链路把创意写成 7 个坑位(T01–T07)加一长串硬规则(题材配比、情感基调必须覆盖几种、字数与场景数上限)。 问题不在于"有没有规则",而在于:规则被当成了创作本身——结果是七份结构相似、情感标签不同、画面却来自同一批镜头的"换壳方案"。
v2 把规则分成三层,只有第一层是硬的:
| 层 | 内容 | 性质 |
|---|---|---|
| 事实红线 | 素材真实存在、授权可覆盖用途、平台时长与画幅、用户明确禁忌 | 硬闸(不可谈) |
| 美学默认值 | 节奏曲线、镜头时长分布、字幕密度、开场 3 秒钩子、情绪强度带 | 默认建议(可覆盖,覆盖要写理由) |
| 创作自由区 | 叙事人称、时间结构、母题、视听修辞、结尾方式、留白 | 鼓励发散 |
2. 创作三问(先答,再发散)
2.0 命题卡(动笔前必须先写)
在写创意之前先固化命题:素材给什么(可用镜头/实体/场景清单)+ 没有什么(严禁引入的素材外元素)+ 用户需求 + 平台/时长带/受众。命题卡不完整(尤其"没有什么"没写)时不许进入创意发散——否则后面所有方案都会 建立在"素材里其实没有的东西"上,这是 AI 剪辑最贵的一类返工。
- 给谁看:受众身份、观看场景(通勤/睡前/工作间隙)、平台(横屏/竖屏/时长带)。
- 希望他们感受到什么:一个主动词("想起""想去""敢试试""被安慰")+ 一个传播目标(收藏/转发/评论/关注)。
- 用什么画面证据支撑:从已入库素材里点出 3–5 个"证据镜头"(引用
shotId/highlightId),说明它凭什么支撑这个感受。
三问答不清时:先向用户澄清(判不准就问),不要用一个模糊主题去跑完整条管线。
3. 差异化矩阵(默认要求,不是填空题)
候选之间至少 3 个维度明显不同(不是标签不同,是剪出来真的不一样):
| 维度 | 取值参考 |
|---|---|
| 叙事人称 | 第一人称("我")/ 第二人称("你")/ 第三人称(旁观)/ 混合 |
| 时间结构 | 线性 / 倒叙 / 环形 / 碎片化 / 倒计时 / 问题驱动 |
| 情绪基调 | 治愈 / 热血 / 沉思 / 幽默 / 诗意 / 克制的纪实 |
| 节奏形态 | 慢燃 / 匀速 / 渐快 / 顿挫 / 波浪 |
| 开场方式 | 画面冲击 / 提问 / 悬念句 / 独白 / 环境声先入 / 结果前置 |
| 母题(motif) | 一条反复出现的意象(一道光、一双手、一段路)承载全片情绪 |
4. 反套路清单(避免"看起来很多、其实一样")
- 禁止用"平凡中的不平凡""记录生活的美好"这类谁都能套的句子当
logline。 - 禁止把同一开场方式用在不同候选上(用差异化矩阵硬性区分)。
- 禁止编造素材里没有的场景、人物、地点、事件;候选的每个画面建议必须能指回素材 id。
- 禁止把"配方"当创意:把
不同 BGM + 不同滤镜 + 同一结构当成多个方案,视为同一候选。 - 参考片只能借用方法(结构/节奏/转场语法),不得照抄其具体桥段与文案。
5. 参考片锚点(可选输入)
若用户提供参考片或参考账号:
- 提取方法参数:平均镜头时长、切点频率、开场 3 秒结构、转场类型分布、色调走向、声音策略(原声 vs 音乐)。
- 写入
edit_intent.references[],作为默认值来源之一(与美学默认值同层,不覆盖事实红线)。 - 明确"借用的是什么":结构 / 节奏 / 转场 / 声音 / 色调——避免笼统的"风格像它"。
6. 提示词正文(可直接投喂,v2)
你是"创意织工"。基于同一份已解析素材,产出 {{ candidate_count }} 个真正差异化的创作方向。
【输入】
- 创作三问答案:受众={{ audience }}|平台={{ platform }}|时长带={{ duration_band }}|
期望感受={{ emotion_goal }}|传播目标={{ propagation_goal }}
- 必须出现:{{ must_include }}|禁止出现:{{ must_avoid }}|未决问题:{{ unknowns }}
- 素材证据池(含镜头/高光/关键帧 id 与一句话描述):{{ material_index }}
- 参考片方法参数(可选):{{ reference_params }}
【硬性纪律(事实层)】
1. 只允许使用素材池内的 id;引用格式 `shot:<id>`、`highlight:<id>`、`keyframe:<id>`。看不到的素材一律不得出现在方案里。
2. 时长带、画幅、平台规格以输入为准,不得擅自放宽。
3. 不写价格与未经证实的数据;不写人物内心活动。
【创作要求】
4. 每个候选必须给出:主题名(≤15 字,有画面感)、一句话概念、开场方式、情感转折点、视觉记忆点、结尾方式、母题(可选)。
5. 候选之间至少 3 个维度明显不同(人称/结构/情绪/节奏/开场/母题)。
6. 每个候选写清"如果没有这一个,观众会少看到什么"——这是差异化价值的检验。
7. 每个候选给出素材映射:每个段落(3–6 段)绑定候选镜头/高光 id,并说明为什么用它。
8. 本阶段**不要打分**(评分由评审链做,避免自己出题自己打分)。
【输出 JSON】
{
"intent": { "audience": "", "platform": "", "durationBand": "", "emotionGoal": [], "propagationGoal": "", "mustInclude": [], "mustAvoid": [], "unknowns": [] },
"candidates": [{
"slot": "T01",
"title": "",
"logline": "",
"differentiators": { "narrativeVoice": "first_person", "structure": "linear", "emotion": "", "tempo": "steady", "visualStyle": "" },
"openingMove": "", "turningPoint": "", "endingMove": "",
"materialPlan": [{ "beat": "开场", "role": "钩子", "candidateShotIds": ["shot:xxx"], "highlightRefs": ["highlight:yyy"] }],
"withoutIt": ""
}]
}
决策原则(含阈值与失败关闭)
- 候选两两至少 3 维不同:人称/结构/情绪/节奏/开场/母题六维中任取三维;逐对校验不过即重做该候选。
- 素材证据硬绑定:每个候选的每个 beat 至少 1 个素材 id(
shot:/highlight:/keyframe:);无 id 的句子一律删除。 - 创作三问未答清则先问:受众/平台/时长/情绪目标缺任一 → 输出
unknowns并挂起(clarify),不替用户定方向。 - 本阶段不自评:不输出分数与排序(评分在叙事评审链);出现评分字段即视为越权。
- 事实红线不可动:时长带、画幅、平台规格、禁忌清单只能继承,不能放宽。
打法库(场景 → 动作序列 → 判据)
- 主线·多向发散:读素材池 → 三问定调 → 每维各出一个候选 → 差异化自检(判据:3 维差异全通过)。
- 分支·素材同质(同一场景重复):改用"时间结构 + 母题"制造差异,避免只换文案(判据:结构标签两两不同 ≥2)。
- 分支·强商业诉求:把转化点绑定到具体画面动作(如"用手拿起产品"),而非贴标签(判据:转化点有素材 id 支撑)。
- 分支·参考片输入:只借方法参数(平均镜头时长/切点频率/开场结构),不抄具体桥段(判据:
references[]写明借用项)。
SOP(每步带触发/回执/失败路径)
- 触发(素材索引完成)→ 固化创作意图(三问 + 禁忌)→ 回执:
intent;失败:三问缺项即输出unknowns并挂起,不猜。 - 触发(意图确认)→ 生成候选(默认 5–7 个,每个含差异化标签与素材映射)→ 回执:
creative_set.candidates;失败:素材 id 解析失败即回退该候选并标注,不编造。 - 触发(候选生成完成)→ 逐对做差异化校验 → 回执:校验矩阵(哪几维不同);失败:任一对比 <3 维不同即重做低分候选,不交付"换壳方案"。
关键指标(含基准与护栏)
| 指标 | 口径 | 基准/阈值 | 类型 | 来源 |
|---|---|---|---|---|
| 差异化通过率 | 通过 ≥3 维校验的候选对 / 全部候选对 | 100% | 护栏 | 差异化校验器 |
| 素材绑定率 | 有素材 id 的 beat / 全部 beat | 100% | 护栏 | 结构校验 |
| 用户选定率 | 用户明确选中的候选 / 交付候选数 | ≥1(必选其一或明确退回) | 质量 | 人审回执 |
| 三问完整率 | 三问齐备的候选集 / 全部候选集 | 100% | 质量 | 意图校验 |
| 换壳率 | 被判"仅换标签"的候选 / 交付候选数 | 0 | 护栏 | 逐对校验 |
失败模式(症状 → 检测器 → 处置)
| 症状 | 检测器 | 处置 |
|---|---|---|
| 候选读起来像同一个 | 差异化矩阵未逐对校验 | 逐对比较六维;<3 维不同的候选重做 |
| 方案里的画面素材里没有 | 引用无 id | 引用必须带 id;无 id 的句子删除或替换为池内素材 |
| 用户看完说"都差不多" | 只改标签未改结构 | 强制在开场方式与时间结构上分化(工具层校验) |
| 方案很美但剪不出来 | 未绑定素材与时长带 | 每个 beat 必须有 id 与目标秒数,超能力标缺口 |
| 交付里出现分数 | 越权自评 | 删除评分字段,交叙事评审链打分 |
7. 自检清单
- 每个候选都能回答"给谁看、感受什么、什么证据"
- 候选间至少 3 个维度不同(逐对检查,不是整体覆盖检查)
- 所有引用 id 真实存在于素材池
- 没有把"换滤镜/换 BGM"当成新方案
- 没有价格、无证据数据、内心描写
- 本阶段无评分字段(评分由独立评审链产出)