Communitygithub.com

784697524-ux/yishufan-viral-video-replica-workflow

内置历史爆款向量案例库,支持新视频拉片、双模型 ASR、Seedance 提示词与分层质量门禁的 Codex Skill

yishufan-viral-video-replica-workflow 是什麼?

yishufan-viral-video-replica-workflow is a Claude Code agent skill that 内置历史爆款向量案例库,支持新视频拉片、双模型 ASR、Seedance 提示词与分层质量门禁的 Codex Skill.

相容平台Claude CodeCodex CLI~Cursor
npx skills add 784697524-ux/yishufan-viral-video-replica-workflow

在你喜歡的 AI 中提問

開啟一個已預先載入此 Agent Skill 的新對話。

說明文件

艺术犯爆款短视频复刻工作流 v6.1

便携包路径

把“包含本 SKILL.md 的目录”作为 SKILL_DIR。本包已在 vendor/watch/ 内置拉片、字幕提取和 ASR 后端,命令示例中用下面的便携路径:

SKILL_DIR="<包含本 SKILL.md 的完整路径>"

交付边界

默认交付参考证据、商品事实、产品与视觉风格锁、机器可读复刻合同、逐秒脚本、人物设定、独立分镜图、逐镜头运动计划、按模型时长拆分的Seedance提示词和生成前验证报告。

除非用户明确要求,否则不得生成视频、消耗积分、导出成片或发布。用户明确要求完整制作时,先通过生成前门禁,再完整读取VidMuse完整制作分支;没有真实证据支撑的内容标记为“创作推演”。

最小输入

  • 对标来源二选一:一个参考视频的本地完整路径/公开链接,或明确写“智能参考历史爆款库”。
  • 商品截图或详情资料;实物商品必须有足以锁定外形、比例、颜色、材质、结构和Logo的清晰产品图。只有卡券/权益页时不得虚构未展示的实物角度。
  • 风格参考图或可作为风格证据的参考视频;没有独立风格图时,明确以原片为风格源,不得凭空补成通用“高级感”。
  • 复刻模式与节拍密度;用户未指定且不同选择会改变结果时,只询问一次。

默认规格:9:16、中文普通话、每个生成片段1至15秒。写AI表时人物、分镜、音频和商品素材总计最多9个附件。高保真视觉复刻默认跟随原片完整时长;另外两种模式在用户未指定时默认30秒。不得为了凑两段删掉原片反转。

内置爆款向量案例库(智能参考模式)

本技能的 knowledge_base/index.sqlite3 是安装即用的种子库:只包含正式项目案例,不包含私人聊天、API Key、Cookie或原视频。它使用本地固定 2048 维中文字符与机制标签哈希向量,检索不调用付费 Embedding 服务。

用户只提供卡券/商品,或明确要求从历史爆款中智能选对标时,必须先检索本地向量库,不得靠印象随意挑案例。首次安装后直接检索,无需先建库:

python3 "${SKILL_DIR}/scripts/viral_library.py" search \
  "<完整创作需求>" \
  --top-k 5 \
  --out "<项目目录>/00_historical_match.md"

把商品、人群、使用场景、视觉世界、人物关系、目标情绪、节拍密度和已确认权益合成一段完整查询,不只输入商品名。搜索结果会给出案例 ID;需要读取该案例在库内存档的完整文本时运行:

python3 "${SKILL_DIR}/scripts/viral_library.py" show "<case_id>" \
  --out "<项目目录>/00_historical_case.md"

对新视频完成拉片、脚本、分镜或复盘并放入工作区 outputs/后,刷新用户本地索引。该索引默认合并内置种子库,搜索时优先使用它:

python3 "${SKILL_DIR}/scripts/viral_library.py" build \
  --workspace "<爆款视频工作区完整路径>"

后续检索时加 --workspace "<爆款视频工作区完整路径>",即可检索“内置案例 + 用户新案例”合并库。

默认不索引私人 Codex 聊天。只有用户明确要求建立纯本地私有库时才可加 --include-chats;含聊天的数据库不得对外分发。

检索报告必须同时给出:一个主对标、一个可复用生产模板、最多两个候选参考、命中机制、可追溯的分析/脚本/提示词/分镜路径、原视频当前是否可用,以及本次必须吸取的失败教训。执行规则:

  • decision=insufficient_match时停止强行套模板,改为请求新参考视频或只做原创机制推演。
  • quality_status=blocked的案例不得复用其脚本、提示词或分镜;若存在可信原片分析,只能复用reference_analysis_only,同时读取其QC复盘作为负面门禁。
  • quality_status=unknown不等于成功,只表示历史材料没有发布级结论;进入本次创作后仍须通过所有质量门禁。
  • 种子库不携带原视频或原机器资产;只能引用库内存档的时间码、哈希、分析、脚本和失败教训,不得声称本轮重新观看了原视频。
  • 用户本地库即使显式包含历史聊天,聊天权重仍低于工作区正式产物,不得替代拉片证据。
  • 检索只负责选机制和资产,不直接拼接旧脚本。仍须进入阶段三的创意竞争、商品删除测试、逐拍桌读和schema v4故事合同。

用户提供了新参考视频时,仍可用该库检索相似案例与失败教训作为辅助,但主参考身份、时长和SHA-256必须以本轮真实读取的新视频为准。

阶段零:锁定模式、视觉世界和素材身份

生成脚本或分镜前先输出:

本次模式:高保真视觉复刻 / 爆款机制迁移 / 商业混合复刻
节拍密度:跟随原片 / 标准密度 / 高密度反转
制作范围:素材包 / AI表交付 / 完整视频
运动类型:参考片主导 / 剧情表演 / 连续运动广告
推断理由:
视觉世界硬约束:

完整读取 references/三种复刻模式.md。只能执行一种模式。用户明确指定的媒介、IP方向或画面世界是全局硬约束,不因“允许替换人物/场景”而失效;例如历史艺术化CG不得自行改成现代真人言情。

运行后端前回读用户本次提供的绝对路径或URL。禁止根据相似文件名选择其他素材。

阶段一:运行证据后端

后端契约见 references/backend_contract.md。先检查阿里云配置:

python3 "${SKILL_DIR}/scripts/configure_asr.py" --check

缺少配置时运行以下命令;Key通过隐藏输入读取,禁止放进命令行、技能文件或报告:

python3 "${SKILL_DIR}/scripts/configure_asr.py" \
  --endpoint "<阿里云业务空间 compatible-mode/v1 Endpoint>"

准备参考证据:

python3 "${SKILL_DIR}/scripts/prepare_reference.py" "<参考视频>" \
  --out-dir "<项目目录>"

该脚本必须完成:

  • 本地素材绝对路径、文件名、SHA-256、时长、画幅和音视频参数锁定。
  • 全片关键帧抽取及前3秒2fps无去重密集抽帧。
  • 额外生成全片固定0.5秒时间线;即使场景静止也不得去重。
  • 强制使用阿里云业务空间,不走默认Groq。
  • paraformer-v2paraformer-v1分别转写并生成时间码。
  • 双模型文本不一致时标记“需复核”,不得直接当成角色对白。

先逐张查看watch/timeline_0_5s/timeline_manifest.json列出的全片固定0.5秒帧,再查看场景关键帧。必须在复刻合同记录查看数量和最后时间戳;只看场景关键帧容易漏掉长停顿、尾段静态表演和循环结尾。发现连续误导、快速动作或空间反转后,对每个反转簇补跑:

python3 "${SKILL_DIR}/vendor/watch/scripts/watch.py" "<参考视频>" \
  --detail balanced --start <起点> --end <终点> \
  --fps 2 --no-dedup --resolution 1024 --no-whisper \
  --out-dir "<项目目录>/watch/reversal_<编号>"

本技能的“逐帧分析”指:全片固定0.5秒时间线逐张查看、场景关键帧逐张查看、前三秒和反转簇密集抽帧逐张查看。watch最高2fps,不能声称已查看视频的每一个原始编码帧。用户明确要求30fps全帧审查时,必须说明需要单独的全帧计算机视觉流程。

ASR只证明识别到声音,不自动证明说话人身份。对白必须用双模型结果、可见字幕、口型和画面动作共同校对;背景歌词与角色对白分栏记录。

阶段一必须产出:

  • 00_source_manifest.json00_reference_evidence.md
  • 视频时长、画幅、抽帧数量、转写模型和转写状态。
  • 带时间码对白表;每句标记角色对白/歌词/音效/需复核。
  • 带时间码镜头表:景别、人物、动作、表情、视线、空间关系、运镜和声音。
  • 前3秒逐秒证据、反转簇逐秒信息变化、品牌首次出现时间和结尾记忆点。

若原片的音乐、破风、撞击、关机声或循环声是反转的一部分,在声音表中单列时间码。需要把原声交给视频模型时,使用scripts/extract_reference_audio.py截取原片单一混音轨;必须说明其中可能同时含音乐、对白和音效,不得声称已分离纯音乐。

阶段二:提取机制、事实表与产品/风格双锁

必须回答:第一秒为什么停留、为什么继续看、初始误判是什么、何处改变权力/因果/道具含义/空间真相、商品为何成为剧情答案、最后3秒为何值得看完。

切镜、换角度、重复爆炸或持续喊叫不算反转。高密度反转仅用于已测出的反转簇;簇内每秒至少新增一个有效变量,每2至3秒升级一个层级,且后一变化由前一变化造成。

商品事实表至少包含商品名、售价、权益、适用门店、售卖期、可用期、核销方式、限制和退款规则。每项标记素材来源与确认状态。不得把资格券写成免费商品,不得补写看不清或未提供的价格、数量、日期和限制。

同时创建02_visual_lock.md

  • 产品锁:列出每张产品参考资产的相对路径、SHA-256和用途;逐项锁定外形、比例、颜色、材质、结构和Logo。没有证据的侧面、背面、接口、包装文字等统一执行do_not_invent
  • 风格锁:从风格参考或原片提炼光线、色彩、构图、镜头语言、人物、场景和材质质感,生成唯一lock_id和一段可复用风格提示词;每个Clip提示词必须逐字带入该提示词和lock_id
  • 禁用项只记录本次素材和用户明确要求的冲突风格。原片本身是霓虹或赛博朋克时不得套用通用禁令。

这一步只锁证据,不构思创意。产品参考资产必须复制进项目目录并绑定哈希;存在多个角度时分别标注用途,不能把AI推测图冒充原始产品证据。

阶段三:创意室竞争与桌读准入

禁止看完参考片后直接写逐秒脚本。先把参考片拆成机制DNA:开场钩子、观众问题、初始误判、冲突发动机、反转机制、情绪回报和结尾记忆点。这里只继承传播机制,不抄表面台词。

编剧轮先写至少5套真正不同的故事概念;当用户明确要求“高预算动态广告”或motion_profile=continuous_motion_ad时写10套。每套至少改变人物关系、冲突来源、人物选择、商品介入、反转方式或结局回扣中的两项。每套都要写一句话故事、冲突、人物选择、可见后果、意外转折、前置证据、商品戏剧作用和结尾兑现;连续运动广告还要用一行写清“人物启动→产品介入→环境变化→动作升级→高潮→产品收束”的6至8个连续动作节点。禁止用换词或换装伪造多方案。

编辑轮逐套评分:前3秒钩子20、因果25、新鲜感20、商品因果15、参考机制继承10、AI可生成性10。连续运动广告另做动态强度、视觉冲击、运动连续、人物与产品关系、叙事完整和拆分可执行性比较,不改变合同100分主评分。入选方案必须总分不低于85且没有硬否决;未入选方案必须写明淘汰原因。编辑轮可以否决全部方案并要求重写。以下任一项为硬否决:人物无动机转向、商品清单式口播、商品移除后剧情仍成立、无铺垫魔法、道具无来源、旁白替代关键动作、结尾口号代替剧情兑现;连续运动广告还否决人物只摆拍/慢走、只换背景和用运镜冒充主体动作。

把入选方案提升为narrative_qc.story_chain后做桌读。逐个故事步骤回答:观众此刻追问什么、本拍新增什么、谁做了决定或反应、哪个可见动作推动下一拍、演员能否在分配秒数内自然完成。必须朗读对白计时,并执行“删除商品”测试;删除商品后故事仍成立就退回创意室。所有桌读问题清零前不得进入逐秒脚本。

把机制DNA、5套候选、逐项分数、硬否决、选择/淘汰理由和桌读结果写入合同creative_room。机器门禁只验证证据和准入条件,不能宣称发布前已经保证爆款;发布后的前三秒留存、完播和互动数据才验证传播结果。

阶段四:原片节拍账本、复刻合同和唯一映射

先把原片每一次因果、权力、道具含义、空间真相和循环关系写成按时间排序的Rxx节拍账本。高保真模式下,责问→误判→攻击→道具揭示→赔罪→二次误操作→空间揭示→结尾循环等相邻因果节点不得合并、换序或删除;商品只能进入用户明确允许替换的位置。

03_structure_mapping.md 顶部写明模式、节拍密度、视觉世界硬约束、必须保留和允许替换。建立唯一链路:

R01(原片证据)→ S01(新片脚本)→ B01(分镜文件)→ P01(Seedance段落)

每个新镜头必须填写对标时间码、新片时间码、原片心理/视觉功能、必须保留、允许替换、分镜文件和提示词段落。不得用“感觉一致”代替可验收事实。

同时按复刻合同 JSON 规范创建schema v4的08_replica_contract.json。先用brief_alignment锁定用户原始模式、原始时长、production_scope和最终执行值;任何变更都必须取得用户明确确认并记录原因,禁止为了通过验证静默改约。合同必须覆盖分析文件中全部Rxx,并把每个节拍绑定到唯一SxxPxx、分镜文件和production_design.motion_beats。合同未完成前不得生图或写AI表。旧schema v3只允许复核历史包,新项目不得继续创建v3。

合同使用schema_version=4。先完成creative_room并选出通过85分和桌读门槛的唯一方案,再完成narrative_qc.story_chain和分镜:第一步必须是问题,中间必须有角色选择与可见后果,最后一步必须回答开头问题;每一步用caused_by连接更早步骤。商品至少承担证据、筹码、诱因、障碍或解决工具中的一种。默认allows_unexplained_magic=false;若用户明确指定奇幻世界,才可设为true,并且每次超自然变化仍须由前一动作触发。没有人物选择的“券突然生效、人群突然出现、庆典突然开始”一律视为因果断裂,必须重写。

同时填写:

  • dialogue_requirements:每个非静音Clip至少一条不可丢失关键句或关键词。
  • prop_continuity_requirements:关键道具的出现、交接/使用和结果事件。
  • director_requirements:结尾记忆点与人物“起点→转折→结果”表演弧。
  • finale_policy:只能选story_actionsource_fact_card。前者要求结尾动作/反应在最后3秒可见;后者只允许剧情答案先兑现,再用用户提供的真实事实图收尾,并锁定源文件与起止时间。
  • production_design:记录产品参考资产及哈希、六项不可变特征、风格锁、音乐状态、运动类型,以及每个Pxx的起始状态→人物动作→产品动作→环境反应→运镜→速度变化→结束状态→转场触发→音乐卡点。

每个运动节拍用handoff_in/handoff_out串成从STARTEND的唯一链,并用product_visibility=visible/withheld_for_reveal区分真实露出与剧情延迟揭示;只有visible节拍强制在提示词绑定产品资产。动态镜头必须通过“删除运镜后,人物或环境仍有明显运动”测试;有意静止只允许原片证据、开场短暂蓄力或结尾产品落版,并写明原因。复杂动作必须绑定起始、中间、结束至少三张关键帧。连续运动广告至少有三次不同等级的动态升级,最高等级不低于4。

按模式执行:

  • 高保真视觉复刻:保留镜头顺序、时长比例、景别、机位、运镜、动作方向、转场、场景结构和光色。
  • 爆款机制迁移:保留停留点、误判路径、权力变化、反转层级、因果升级和结尾记忆点,不要求逐镜画面相似。
  • 商业混合复刻:0至3秒重构商业冲突;3秒后恢复原片镜头顺序、时长比例和视觉节拍。

不得额外套用其他模式的验收规则。

阶段五:按原片因果链写逐秒脚本并动态分段

先完成整条逐秒脚本,再在不切断台词和反转因果的位置拆成若干Clip。每段必须1至15秒,从0秒连续覆盖目标时长。每段最多3个可执行单元;剧情片最多2个说话单元和1行主商品事实。每个时间单元必须使用可解析的Markdown表格,时间列可在前三列,格式为起点-终点,并写清Sxx/Pxx、景别、运镜、人物左右/前后站位、身体与视线方向、说话人与对象、手部和身体动作、表情起点/变化/结果、普通话对白、嘴型同步、连续性锚点和声音。

脚本完成后立即运行自动解析,不再人工自报口播秒数、汉字数和节拍数:

python3 "${SKILL_DIR}/scripts/analyze_script.py" \
  "<项目目录>" --out "<项目目录>/07_script_analysis.json"

程序按4.2字/秒计算最低口播时长;剧情对白最多占Clip的60%,蒙太奇旁白最多75%,古诗朗读最多92%。它还会拒绝超载单元、过多说话轮次、商品清单式对白、未经允许的前三成商品前置和无解释魔法。出现错误时不得生图。

商品硬卖原则上不得出现在前30%。商品在中后段通过已确认权益解决剧情问题;原片本身用商品作第一秒钩子时,只有用户明确要求且商品事实完整才允许前置。结尾默认必须有动作、群体反应或二次反转。只有finale_policy.type=source_fact_card时,才允许在剧情问题已经可见解决后,用1至2秒真实商品/权益原图收尾,最长不得超过2.5秒;禁止用AI重绘图或未绑定源文件的静态海报代替剧情兑现。

阶段六:人物设定与独立分镜图

在第一次生图前完整读取当前 Codex 环境已安装的 imagegen 技能说明,默认使用内置 image_gen,不擅自切换CLI/API。

  1. 先生成统一人物设定图:正面、侧面、背面和关键表情。
  2. 将人物设定作为所有剧情图的身份参考。
  3. 每个分镜单独调用一次生图;禁止用九宫格、漫画分栏或拼贴代替独立分镜。
  4. 每张图保存到项目目录,并逐张检查人物、场景、道具、动作方向、说话对象、除白名单外无字幕/二维码/无关文字及9:16尺寸。
  5. 相邻Clip的尾帧/首帧必须复用同一文件或像素一致的副本;人物位置、姿势、朝向、道具、时间和光线保持一致。
  6. 用户指定扇面、招牌、包装等必须出现准确文字时,只允许该白名单文字;在生图提示词中逐字写明、生成后用view_image真实查看,确认不镜像、不错字,再写入合同的visual_text_requirements。此时禁止继续使用“画面无任何文字”这种冲突限制。
  7. 复杂动作分别生成起始、中间和结束关键帧;参考资产只锁身份、产品和状态,不得把人物姿势锁死。关键帧只作为视频模型输入,不得直接当成最终动态镜头。

每张分镜必须绑定镜头ID、时间点、对标时间码、画面目的、景别/机位/构图、动作三态和生图提示词。

阶段七:Seedance提示词

每个片段输出一个可整段复制的代码块,包含画幅、精确时长、产品锁、风格lock_id与完整可复用风格提示词、参考图作用、逐秒镜头、动作、对白对象、普通话嘴型同步、首尾连续性和负面限制。

提示词开头必须逐个列出本段实际附件文件名和作用;正文每个Pxx再次写对应分镜文件名。不得只写“参考附件”。如果使用原片音乐或音效,合同必须分别记录原片截取区间和目标片使用区间,提示词必须写音频文件名、目标开始/结束时间和“不换其他音乐”。“原片同段BGM”不能代替文件名。

除合同白名单指定文字外,画面不得生成字幕、英文、二维码和无关信息。高保真和商业混合模式按镜头ID写明顺序、时长、机位、运镜、动作方向和转场;机制迁移的高密度档先给逐秒节拍表,再以相同顺序写入提示词。

每个Pxx必须逐项复述合同中的运动链:起始状态、人物连续动作、产品运动、环境反应、摄影机空间运动、速度变化、结束状态、动作触发转场和音乐卡点。单镜头只设一个主要人物动作和一个主要摄影机运动;人物动作复杂时简化运镜,运镜复杂时简化人物动作。禁止用摄影机推拉、数字缩放、背景替换或快速切换冒充动态事件。

阶段八:可选AI表交付

只有用户明确要求写入AI表时才执行。先使用钉钉技能读取真实Base、子表、字段和目标记录,把自动视频、公式、成本和生成结果字段加入合同aitable_handoff.protected_field_ids。写入只允许提示词和附件字段;每条记录人物图、分镜图、音频和商品素材合计最多9个附件,必须先为人物图和音频预留名额,再决定分镜数量。更新附件时先回读当前附件并做完整保留式替换,禁止只提交新增文件导致旧附件丢失。每条记录写后必须回读:提示词引用、附件文件名/数量、受保护字段的原值都要保持;不得顺手点击生成按钮。用户明确要求生成后,逐条回读记录ID→Clip ID→结果文件/链接→实际时长→分辨率→完成状态,下载后只能按合同的Clip时间顺序合片,不能按下载时间或表格行位置排序。

阶段九:验证后交付

使用 templates/生成前质检表.md 完成内容质检,再运行生成前总门禁:

python3 "${SKILL_DIR}/scripts/run_quality_gate.py" \
  "<项目目录>" --stage pre-generation \
  --out "<项目目录>/07_quality_gate_pre_generation.json"

只有decision=allow_generation才能生图或写AI表。总门禁同时执行合同/资产验证和自动脚本分析;失败时给出应退回的层级。--legacy只能检查旧包,不能作为新项目交付依据。

用户明确要求使用VidMuse完成生成、剪辑和导出时,只有在这里取得allow_generation后才进入VidMuse完整制作分支。该分支必须先实时读取账号、积分、可用模型和生成参数,再计算包含问题镜头重生额度的预算;不得仅根据本文或历史记录假定模型名、价格、时长和时间线能力。没有明确生成请求时在此停止。

用户提供生成成片后,再运行结构验收:

先为AI表返回的分段视频建立09_delivery_manifest.json,只按合同顺序登记clip_id和实际文件:

{"outputs":[{"clip_id":"clip01","file":"renders/clip01.mp4"}]}

生成后清单格式见生成后质量清单规范。必须准备AI表片段清单、候选ASR清单和Watch导演证据;合片前运行:

python3 "${SKILL_DIR}/scripts/run_quality_gate.py" \
  "<项目目录>" --stage pre-stitch \
  --delivery-manifest "<项目目录>/09_delivery_manifest.json" \
  --asr-manifest "<项目目录>/10_asr_manifest.json" \
  --director-manifest "<项目目录>/11_director_qc.json" \
  --out "<项目目录>/12_quality_gate_pre_stitch.json"

只有decision=allow_stitch才能合片。它会拒绝缺段、错序、重复片段、时长误差、非9:16、无音轨、关键口播丢失、故事步骤不可见、表演弧缺失、道具无来源、连续性失败、结尾记忆点缺失、硬否决项或导演评分低于85。

高保真成片再运行参考片结构验收:

python3 "${SKILL_DIR}/scripts/validate_render.py" \
  "<原片>" "<成片>" --out "<项目目录>/质检/render"

成片总时长、镜头变化密度、音频中位能量或音频低分位动态未达门槛时,直接判定“未对齐”,不得因为主剧情事件出现就称为高保真。低分位动态用于发现总体音量尚可、但爆炸、打击、转场音乐等关键区间实际缺失的情况。随后查看脚本生成的全部0.5秒帧,并用候选ASR逐字核对合同中的对白。

不论模式,AI表返回的每个片段还要单独核对实际时长与合同片段时长(误差不超过0.5秒)、人物/道具连续性、narrative_qc中的每一步因果和片段顺序;任何一项失败都只算“生成结果”,不得合片或发布。

合片后必须对最终MP4本身重新运行prepare_reference.py,把双模型ASR和固定0.5秒时间线写入独立质检目录;不得把分段ASR手工复制后冒充最终合片ASR。按生成后质量清单规范建立13_final_manifest.json,其中最终视频、ASR证据文件和真实事实图都必须用SHA-256绑定。然后对所有模式运行:

python3 "${SKILL_DIR}/scripts/run_quality_gate.py" \
  "<项目目录>" --stage pre-publish \
  --delivery-manifest "<项目目录>/09_delivery_manifest.json" \
  --asr-manifest "<项目目录>/10_asr_manifest.json" \
  --director-manifest "<项目目录>/11_director_qc.json" \
  --final-manifest "<项目目录>/13_final_manifest.json" \
  --out "<项目目录>/14_quality_gate_pre_publish.json"

只有decision=allow_publish才能称为“可发布”。最终门禁会真实回读合片时长、画幅、音轨和哈希,从ASR证据文件加载至少两个不同模型的结果,并验证事实卡在成片中的像素相似度。双模型不一致时,必须由真实听过成片音轨的人填写复核人、时间、确认的对白ID和原因;模型或ASR结果本身不得把human_audio_qc标成通过。高保真模式还须附加--render-validation,作为原片结构对齐的额外门禁。

标准交付目录

outputs/<项目名>/
├── 00_source_manifest.json
├── 00_reference_evidence.md
├── 01_reference_analysis.md
├── 02_product_facts.md
├── 02_visual_lock.md
├── 03_structure_mapping.md
├── 04_script.md
├── 05_seedance_prompts.md
├── 06_pre_generation_qc.md
├── 07_script_analysis.json
├── 07_quality_gate_pre_generation.json
├── 08_replica_contract.json
├── 09_delivery_manifest.json(生成后)
├── 10_asr_manifest.json(生成后)
├── 11_director_qc.json(生成后)
├── 12_quality_gate_pre_stitch.json(生成后)
├── 13_final_manifest.json(合片后)
├── 14_quality_gate_pre_publish.json(合片后)
├── asr/
├── audio/(需要原片音乐或音效时)
├── watch/
├── character/character_sheet.png
└── storyboard/(每段独立PNG;写AI表时须为人物图、音频等预留总附件9个以内的名额)

调用模板见 templates/调用模板.md

成片复盘边界

用户之后提供成片时,先运行最终MP4的双模型ASR和pre-publish总门禁;高保真模式再运行validate_render.py。然后确认目标是“对应关系核对”还是“质量评价”。对应关系核对比较原片固定时间线、脚本、分镜、提示词、成片时间码和候选ASR;不用品质形容词替代镜头链路证据。单帧表情夸张不等于表演对齐,必须检查表情的起点、变化和结果;出现新道具时必须看到取出、交接或变形动作。

相關技能