Community生产力与协作github.com

geniusdapeng-collab/WorkLoom-video-edit

字幕与文案官方套件(v2):与时间轴逐段绑定的字幕写作、虚拟拼接组(VMG)合并规则、字数带控制、标题与结尾话术位,含提示词全文与合规口径。

WorkLoom-video-edit 是什么?

WorkLoom-video-edit is a Claude Code agent skill that 字幕与文案官方套件(v2):与时间轴逐段绑定的字幕写作、虚拟拼接组(VMG)合并规则、字数带控制、标题与结尾话术位,含提示词全文与合规口径。.

兼容平台~Claude Code~Codex CLI~Cursor
npx skills add https://github.com/geniusdapeng-collab/WorkLoom-video-edit/tree/HEAD/bundles/video-edit/skills/caption-craft

Installed? Explore more 生产力与协作 skills: steipete/gemini, steipete/gh-issues, steipete/skill-creator · View all 6 →

在你喜欢的 AI 中提问

打开一个已预加载此 Agent Skill 的新对话。

文档

字幕与文案(caption-craft v2)

与生成链路的区别(重要):AI 剪辑链路的字幕是剪辑的一部分,不交给后期去"补一层字"。 字幕按原始素材时间码绑定镜头写(《剪辑脚本字幕版(音画强关联)》),输出 video_title / video_id / total_duration / video_groups[group_name, group_duration, shots[original_timestamp, subtitle_text]];出现规则(≥2s / VMG)、 字数带、断句格式、结尾话术固定块见 docs/video-edit-creation-doctrine.md §5。 本地把字幕版转成交付字幕文件:pnpm edit:subtitle -- --timeline … --caption … --out ….srt; 字体/版式/平台安全区仍由后期字幕工位执行。

1. 定位

字幕不是"把台词抄一遍",而是画面信息的第二层表达:补足画外信息、加强节奏、给出钩子与落点。 本技能产出 caption_script:与时间轴逐段绑定,可直接进字幕工位与封面工位。

2. 出现规则(硬口径)

情形规则
单镜时长 ≥2.0s必须上字幕
单镜时长 <2.0s不加字幕
连续多个 <2.0s 镜头合并为虚拟拼接组(VMG);合并总时长 >3.9s 时,在 VMG 第一镜上写一条覆盖全组的概括字幕

3. 字数带

最小字数 = ceil(时长秒数 × 2.0)
最大字数 = floor(时长秒数 × 2.5)
  • 超出上限 → 拆句或删修饰;低于下限 → 补画面事实,不补空话。
  • 一条字幕 2–4 行,每行 8–14 字(竖屏可 6–11 字);不做"一行 20 字"的糊字幕。

4. 文字纪律

  1. 每句独占一行(用换行分隔),行内无空格、无标点、无 Emoji。
  2. 只写画面能证明的内容;不写人物内心活动、不写没出现的地点/品牌/数据。
  3. 未提供售价时不写价格;不写"限时""最"等极限词。
  4. 专有名词与素材事实逐字一致(品牌名、地名、产品型号)。
  5. 结尾话术位:若账号配置了结尾话术(例如 AI 制作声明 + 关注引导),保留原口径,不擅自改写。

5. 标题与封面文案

  • 标题:≤12 个中文字符(平台另有要求时按平台),有信息量或悬念,不用问号堆砌。
  • 封面文案:与标题不重复,给"第二句钩子";与主视觉(关键帧候选)匹配,避免字幕压脸。
  • 封面帧优先取 composition_best/emotion_peak 关键帧,标题区避开人脸与重要信息。

6. 提示词正文(可直接投喂,v2)

你是"文案字幕师"。任务:为已锁定的时间轴逐段撰写字幕,并给出标题与封面文案。

【输入】
- 剪辑时间轴(段序/时长/画面要点/台词):{{ edit_timeline_summary }}
- 每段可用的事实(实体/地点/产品/数据,来自镜头理解):{{ shot_facts }}
- 账号口径:{{ account_profile }}(语气/结尾话术/禁用词)
- 平台规格:{{ platform_spec }}

【硬性纪律】
1. 只使用输入事实;没有的不要写。禁止内心描写与未经证实的数据。
2. 单镜 ≥2.0s 必须上字幕;<2.0s 的连续镜头按 VMG 规则合并后写一条概括字幕(放第一镜)。
3. 字数带:ceil(时长×2.0) ≤ 字数 ≤ floor(时长×2.5);每句独占一行,行内无空格与标点。
4. 无价格(除非输入里明确给出);无 Emoji;无外文(专有名词除外)。
5. 结尾按账号口径保留话术位(如"看到这里/感觉怎么样/……"),不擅自改写。

【输出 JSON】
{
  "video_title": "",
  "video_id": "YYYYMMDD-xxxxxxxx",
  "total_duration": "MM:SS",
  "video_groups": [{
    "group_name": "",
    "group_duration": "00:12",
    "shots": [{ "original_timestamp": "0:07.000-0:13.000", "subtitle_text": [{ "text": "第一行\n第二行" }] }]
  }],
  "cover_lines": ["", ""],
  "notes": "VMG 合并说明与留白说明"
}

决策原则(含阈值与失败关闭)

  1. 字幕与时长量化:字数带 ceil(时长×2.0) ≤ 字数 ≤ floor(时长×2.5);超出上限必须拆句,不得压时。
  2. 出现规则硬口径:单镜 ≥2.0s 必须上字幕;<2.0s 不上;连续短镜按 VMG 合并后 >3.9s 才给概括字幕。
  3. 只写画面能证明的:事实字段没有的地名/品牌/数据/价格一律不写;内心活动不写。
  4. 格式纪律:每句独占一行、行内无空格标点、无 Emoji、无外文(专有名词除外)。
  5. 失败关闭:段时长缺失或事实字段缺失时,该段留空并标注待补,不臆造文案。

打法库(场景 → 动作序列 → 判据)

  • 主线·逐段写作:读时间轴段事实 → 定信息点 → 按字数带成句 → 分行(判据:字数带命中率 100%)。
  • 分支·短镜串联(VMG):合并连续 <2.0s 镜头 → 总时长 >3.9s 时在首镜写一条概括(判据:合并不漏内容、不超字数带)。
  • 分支·信息密集型段落:优先保留名词与动词,删修辞;必要时拆成两条并调整起止(判据:可读性抽检通过)。
  • 分支·账号口径冲突:保留账号结尾话术原文,冲突时以账号口径为准并记录(判据:话术逐字一致)。

SOP(每步带触发/回执/失败路径)

  1. 触发(时间轴锁定)→ 逐段撰写字幕 → 回执:caption_script + 字数带校验表;失败:字数越界或含标点即回退重写,不放行。
  2. 触发(字幕初稿)→ VMG 检测与合并 → 回执:合并清单(哪些镜头合并、字幕落在首镜);失败:合并后无概括或落错镜即重做该组。
  3. 触发(字幕定稿)→ 事实口径核对(实体/价格/专有名词)+ 封面文案生成 → 回执:核对清单 + 标题/封面行;失败:出现无依据事实即删除该句并标注,不进交付。

关键指标(含基准与护栏)

指标口径基准/阈值类型来源
字数带命中率落在字节带内的字幕 / 全部字幕100%护栏字数校验器
格式合规率无标点/无空格/无 Emoji 的行 / 全部行100%护栏正则校验
事实准确率与镜头事实一致的字幕 / 抽查字幕≥98%质量20% 人工抽检
VMG 覆盖率连续短镜按 VMG 处理的比例100%护栏VMG 检测清单
封面安全率未压脸/未压平台 UI 的封面文案 / 全部封面100%质量安全区检查

失败模式(症状 → 检测器 → 处置)

症状检测器处置
字幕读不完字数超上限按字数带截断重写;必要时把该段拆成两条
字幕说的事画面里没有事实来源混用了剧情设计只允许引用镜头事实字段;无依据的句子删除
字幕压在脸上未检查安全区换 placement 或改用上方安全区;封面另选关键帧
结尾话术被改写模型自作主张结尾话术视为账号口径,原文保留
短镜被塞满字VMG 规则未执行合并连续短镜;>3.9s 才在首镜给一条概括

7. 自检清单

  • 每条字幕字数落在字数带内;行数 ≤4
  • 每句独立成行;行内无标点/空格/Emoji/外文
  • 字幕内容与对应段的画面事实一致(可逐段抽查 20%)
  • VMG 合并规则已执行(连续短镜合并、>3.9s 给概括字幕)
  • 结尾话术位与账号口径一致
  • 标题 ≤12 字且与封面文案不重复;封面文案避开人脸安全区

Individual skills in this repo

This repo contains 20 individual skills — each has its own dedicated page.

geniusdapeng-collab/WorkLoom-video-edit

配乐交付规范官方套件:原节目默认来源、显式独立分轨授权、单次实际混音、曲目许可与字节证据,完整平台/电平/选段工艺参数和用户返修归因。成功源镜不经声音品质复检,不按余量/可闻度/卡点分数自动重试或降级;绑定 G-BGM0..G-BGM5,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

曲库与许可合规官方套件(随 bundles/ai-video 分发):无版权曲库怎么接、许可白名单与商用红线、TASL 署名怎么出、AI 生成音乐的许可陷阱(MusicGen 权重 CC-BY-NC)、自算作曲为什么是默认路径。安装后被 BGM 配乐师调用;绑定围栏 G-BGM0..G-BGM5,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

配乐定调官方套件(随 bundles/ai-video 分发):题材×场景×情绪→调式/调性/BPM/和弦/配器/结构的选型法,含 32 个题材配方(16 既有 + T-15 新增 16)、速度决策(配方 BPM vs 剪辑点反推)、禁忌清单与"允许不配"。安装后被 BGM 配乐师调用;绑定围栏 G-BGM0..G-BGM5,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

人声分离纪律官方套件(随 bundles/ai-video 分发):什么时候真需要分轨、两档引擎链(demucs/audio-separator → ffmpeg 中心声道近似)、质量等级与诚实标注、单声道与失败处理、与 UVR/Spleeter 的关系。安装后被 BGM 配乐师调用;绑定围栏 G-BGM0..G-BGM5,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

SRT/ASS、字体解析、实际烧录与文字扩展轨的完整执行纪律;默认一次处理、原片原声保持,核对时间轴和真实产物,不抽帧评审可现度或循环选优;遵守 G-SUB 围栏的原片、字体、权限和执行回执约束。

geniusdapeng-collab/WorkLoom-video-edit

摄影知识库调用技能(随 bundles/ai-video 分发):19 篇九章式摄影知识(光学/景别/运镜/光线/色彩/材质/天气/风格/情绪),每篇第六章是「意图→提示词」核心调用区。用于写镜头提示词前定光圈/焦距/景别/光位/色调/材质,把参数意图翻译成画面语言。绑定制片与摄影指导岗位及围栏 G-KB0–G-KB4;卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

调色交付规范官方套件:Rec.709 本地加工、平台派生、滤镜和来源证据、真实产物哈希、版本回滚与用户反馈归因。成功渲染素材默认接受,保留完整参数与工艺参考,未测画面品质如实为空,实际缺件、授权或加工失败保持阻断;绑定 G-COL0..G-COL4,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

调色执行纪律官方套件(随 bundles/ai-video 分发):规格读取、明确校正与风格配方、单次请求加工、多镜参考匹配、来源和输出字节留痕,保留目标值与 profile 工艺知识。成功源镜默认接受,独立诊断不接入品质否决或自动重做;绑定 G-COL0..G-COL4,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

题材、场景、情绪与平台到单次调色配方的选型方法;保留题材表、参数建议、操作流程与失败诊断,成功渲染素材默认进入后期,不以画面评分复核或重做。

geniusdapeng-collab/WorkLoom-video-edit

多镜色彩一致性官方套件:指定参考镜、逐镜派生曝光和色度校正、完整批次结果、原片只读与当前字节证据。保留参考选择与诊断残差的工艺知识,成功源镜默认接受,成片不以残差、肤色或主观跳变自动拒绝重做;绑定 G-COL0..G-COL4,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

评论三级分流 SOP 官方套件(随 bundles/ai-video 分发,F8.1 官方套件级):评论采集→意图分类→三级分流(夸赞 auto/咨询 review/负面 review+告警/敏感 block)、投诉维权关键词必审+告警、外发回执落账。安装后被评论区运营调用;绑定围栏 G10,卸载即撤销(F8.2/L8.3)。

geniusdapeng-collab/WorkLoom-video-edit

封面设计官方套件:按明确标题、主视觉镜号/时刻、平台与账号字体色板一次本地合成,保留字号、安全区、人物布局和标题工艺知识。成功源镜默认接受,不调用模型选帧或整图质量评审,不做 PSNR/墨迹投票自动重做;实际来源、字体、请求和产物失败明确,绑定 G-MAT1/G-SUB3。

geniusdapeng-collab/WorkLoom-video-edit

封面设计知识库(cover-kb)调用技能。为封面设计师岗位提供「平台规范 / 账号定位 / 题材映射 / 钩子公式 / 构图工艺」的结构化检索与注入纪律(14 篇九章式,确定性检索,无向量库)。绑定围栏 G-SUB2/G-SUB3/G-MAT1;卸载即撤销封面 know-how 注入能力。

geniusdapeng-collab/WorkLoom-video-edit

母版、旁挂字幕、软轨、封面、变体、工程与清单的完整交付纪律;含产物表、变体设计、执行参数、来源哈希与逐层失败 SOP。按声明配方实际执行,保留来源与真实错误,不以差异评分、声音质量或默认增强模型再次拒收素材;绑定 G-DLV0..G-DLV9,供后期交付与封面岗位调用。

geniusdapeng-collab/WorkLoom-video-edit

返修闭环官方套件:反馈归因、层影响分析、基础工程版本/SHA 前置条件、独占版本认领、本地增量重合成与复用证据。保留完整反馈表、并发冲突和存储失败 SOP;成功镜头默认接受,组件或旧品质失败不重新生成,点名新生成保持 G8/G-DLV5,绑定 G-DLV4..G-DLV7。

geniusdapeng-collab/WorkLoom-video-edit

导演评审官方套件(随 bundles/ai-video 分发,F8.1 官方套件级):6 问评审 + 5 维评分 + 硬阻断打回、事实红线一票否决、跨集连贯性校验,含硬阻断优先级/平均分不得掩盖短板/事实红线以 confirmed 字段为准等决策原则、四种评审形态打法、五步 SOP 与失败模式表。安装后被连贯审查官调用;绑定围栏 G6,卸载即撤销(F8.2/L8.3)。

geniusdapeng-collab/WorkLoom-video-edit

字体许可合规官方套件(字幕师专业套件):OFL-1.1/Apache-2.0/厂商免费商用三类白名单判定、OFL 四条义务(可商用/禁单售/改后改名/保留声明)、不做子集化的理由、客户自备商用字体的登记口径、证据留痕与围栏 G-SUB5 对应关系。安装后被字幕师调用;绑定围栏 G-SUB1/G-SUB5,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

字体选型官方套件(字幕师专业套件):场景×语言硬过滤、五维加权打分(作品类型/BGM节奏/粗细/艺术气息/气质关键词)、账号视觉锤锁定、中英混排搭配、上位提示词气质命中、否决项与"允许报告无合适字体"。安装后被字幕师调用;绑定围栏 G-SUB0/G-SUB1/G-SUB3/G-SUB5,卸载即撤销。

geniusdapeng-collab/WorkLoom-video-edit

情报五站方法论官方套件(随 bundles/ai-video 分发,F8.1 官方套件级):采集/评价/竞品/核验/装订五站流水,含决策原则(无源不入库/置信度三级/域名去重/冲突不仲裁)、实物 8 路与服务 6 路两套打法、五步 SOP(每步带回执与失败路径)、关键指标护栏与失败模式表。安装后被情报科五站与调研员调用;绑定围栏 G1,卸载即撤销(F8.2/L8.3)。

geniusdapeng-collab/WorkLoom-video-edit

原声 program、显式签章分轨与配乐的来源、策略、时间轴和一次混流方法;默认保留原声,不自动分离或测声音品质,真实非法分轨与混流失败明确停止。

相关技能