Communitygithub.com

ZhongBiao-zheng/video-prompt

AI 视频生成提示词 skill(Seedance 简派 / Kling 等繁派),供 Claude Code / Codex 使用

Qu'est-ce que video-prompt ?

video-prompt is a Claude Code agent skill that aI 视频生成提示词 skill(Seedance 简派 / Kling 等繁派),供 Claude Code / Codex 使用.

Compatible avecClaude CodeCodex CLI~Cursor
npx skills add ZhongBiao-zheng/video-prompt

Demander à votre IA préférée

Ouvre une nouvelle conversation avec cette compétence d'agent déjà préchargée.

Documentation

动手第一步:先分平台

写或优化任何视频 prompt 之前,先确认目标平台,再对症下药——两派规则相反,搞混两边都拉垮:

  • Seedance / 即梦 → 走 B 节(简派:反故事板、反长 prompt、大白话机位、只出音效)
  • Kling / 可灵、Sora、Runway、Hailuo / 海螺、Pika、Vidu,及纯文字生成 → 走 A 节(繁派:结构化骨架、分镜序列、运镜术语、颜色对撞)

用户没说平台,就先问一句:「这是给哪个视频模型用的?」问清再写。

为什么必须分:Seedance 吃简洁,华丽故事板 / 长 prompt 丢进去反而错漏百出;Kling 这类吃结构化堆料。同一段 prompt 在两边效果相反。

再判断模式(两派通用):

  • 创作:有想法没 prompt。描述不足就一次性问全(主体外形 / 场景光线 / 情绪基调 / 时长镜头数),够清楚就直接写。
  • 优化:已有 prompt。内部对照找差距,直接输出优化版,不讲分析过程。
  • 参考图:给了图 / 截图 / 卡面 / 角色图,优先级最高,先定每张图用途再写分镜(A 节走资产绑定,B 节内联进主体 / 镜头行,素材统一标 @Image N / @Video N / @Audio N)。

A · 通用繁派流程

适用:Kling / 可灵、Sora、Runway、Hailuo / 海螺、Pika、Vidu,及纯文字生成。

骨架(二选一)

无参考图:[总纲句:风格+氛围+画质+禁止项] → [场景妆造] → [分镜 A→B→C] → [后期音效/调色]

有参考图 / 图生视频 / UI 动效:[时长+类型+标题] → [逐张参考图资产绑定] → [逐秒时间轴] → [风格与氛围/约束]

六维度(每条 prompt 过一遍)

维度内容
镜头语言角度 + 运镜 + 焦距
主体 + 行为外形 + 动作序列
场景 / 环境地点 + 物理细节 + 氛围
光与质感灯光冷暖 + 材质 + 色彩风格
情绪 + 约束情绪基调 + 明确禁止项
后期调色 LUT + 音乐 + 音效

句式素材库(按需组合,不必全用)

  • 开场·极近起幅:镜头极度贴近 [材质/纹理],随 [触发动作] 焦点丝滑转移至 [主体/远景]。(水面/瓷砖/雪地/幕布等有质感平面)
  • 顶点·暴推特写:[主角] 突然 [停步/回眸],机位零点几秒内暴推至面部极限特写,[妆容/眼神] 与 [背景] 形成 [反差]。(序列中段情绪最强一拍)
  • 顶点·希区柯克变焦:机位极速后退同步推近焦段,背后 [元素] 产生空间拉扯感。(疏离/宏大/孤独)
  • 结尾 A·直视定格:镜头极速推近脸庞,[主角] 在 [动作] 中蓦然回首,[眼神] 直视镜头,画面在 [情绪] 中定格。
  • 结尾 B·光晕溶白:[主角] 转身向 [阳光/远方] 走去,巨大真实光学眩光穿透画面吞没 [场景],白光中 [音效] 干净切出。
  • 结尾 C·背影消隐:[主角] 转身向 [更暗/更远] 走去,背影被 [黑暗/距离] 吞没,只剩 [服装细节],在 [情绪] 中定格。

颜色对撞(设 1–2 组:场景主色 × 服装色)

场景配色
古风/宫廷朱红 × 玄黑 × 暗金
盛唐/华服孔雀蓝 × 暗金
欧洲建筑克莱因蓝 × 纯白
海洋/游艇海蓝 × 柚木白 × 金
沙漠/异域赤陶 × 祖母绿 × 香槟金
自然地景高饱和自然色 × 互补色服装

原则:冷暖对冲 > 同色系渐变;高饱和 + 无彩色 = 奢华感。

运镜词库

中文(英文)触发时机
极近起幅(Macro / ECU Opening)开场,建立质感
轨道推镜(Dolly In)揭示、进入、强调
斯坦尼康平滑环绕(Steadicam Orbit)环绕主体,高端广告感
平稳轨道横移(Steadicam Lateral)跟人行走,高氛围
跟随镜头(Tracking Shot)追逐、陪伴、运动
暴推(Crash Zoom)情绪爆发点
希区柯克变焦(Dolly Zoom)空间拉扯、疏离、宏大
极低仰拍逆光(Low Angle Backlit)权威感、逆光剪影
上摇(Tilt Up)揭示高度、仰望
闪摇(Whip Pan)快速切场、动感
360 度环绕(360 Wrap / Orbit)英雄登场
主体锁定(Camera Locked On Subject)主体静,世界动

参考图绑定(参考图模式)

先提取所有图片引用(保持 URL / ref id / 文件名 / 编号原样不改),给每张图指定唯一用途:画面基底 / 主体基础形态 / 主体目标形态 / 局部资产 / 中间界面。然后:

  1. 一图一角色,不在矛盾身份间切换。主体名称、基础形态、目标形态在用户文本中冲突时以最新明确修正为准,仍无法判断只问一个澄清问题。
  2. 绑定只写中性身份,一句「[图片1] 是 XX 界面 / 角色 / 场景」即可——不描述图内布局 / 颜色 / 元素(那要读者自己看图),也不写「新的 / 替换后的 / 现在的」这类改稿说明。
  3. UI / 卡牌 / 商品类:强调「保持布局、按钮位置、文字层级、卡牌位置不变」,只加光效 / 粒子 / 镜头 / 压暗 / 弹出 / 翻转等动效;转场落点回到用户已有的目标 UI,不重新设计。
  4. 关键镜头里重复引用对应图,明确模型此刻看哪张;每个转折写清「从哪张图 → 到哪张图 / 状态」。
  5. 结尾落在可剪辑画面(目标卡牌 / 进化 UI / 胜利界面 / 定格表情);时间轴总时长等于用户要求时长(15 秒常用 0–2 / 2–4 / 4–6 / 6–8 / 8–11 / 11–13 / 13–15)。

输出铁律

  • 纯文本段落,不用 markdown 表格 / 井号 / 加粗 / 分割线;可用纯文本时间段标签(0–2 秒:)和内联标签(场景妆造简述:后期音效与调色:)。读起来像可直接粘进视频平台的指令,不像文档。
  • 只输出 prompt 本体,不要「好的我来帮你写」的铺垫,不输出分析过程。
  • 运镜名一律「中文(英文)」:轨道推镜(Dolly In)、闪摇(Whip Pan);不能只写英文,也不能中英间只空格不加括号。
  • 禁元说明:不写「新的 / 原来的 / 现在改成 / 这次调整 / 原布局」,除非是画面中真实可见文案。
  • 输出语言随输入、默认中文;不加括号解释(如"(必填)"),不用"一句话"开头概括。

B · Seedance / 即梦心法(简派)

来源:@simonxxoo 高强度实测(2026-07,@ring_hyacinth 转述,即梦 Seedance 2.0)。别人花大量时间踩坑凝练——做 Seedance 就默认按这套,不分是否有参考图。A 节的九大公式 / 颜色对撞在这里退为「借词素材库」:某个 Shot 想要特定运镜(暴推 / 希区柯克变焦)时挑一两个词加进去,绝不整套堆砌。

一头 + 四段 + 一尾,别写华丽小作文:

  • 开头意图(一行):风格 / 媒介 / 光影质感 + 谁在哪做什么;30s 以上可带时长画幅。风格词只许出现在这一行
  • 主体:出一张角色表;即梦里新建主体后 @ 复用,一致性极强
  • 场景:传一张带主角的场景图 → 交代角色大小,避免比例失调
  • 音乐:⚠️ 只出对应音效、不要任何 BGM——方便后期配乐,这条最重要
  • 镜头:每个 Shot 一句「景别 + 发生什么」,言简意赅;30s 版加【阶段功能】
  • 约束(一行):全片连续性锁 + 禁止项(无字幕 / 光向不变 / 某事件不得提前)

输出骨架(大白话机位,无英文术语括注,无颜色对撞段):

[一行全局意图:风格 / 媒介 / 光影质感,谁在哪做什么;≥30s 前置「30 秒、16:9」]

主体:[名]@Image 1(造型简单 / 图够清楚一句带过;易画歪的补关键特征 + 负面约束)
场景:[关键词;有场景图不复述画面,无场景图的全新世界在镜头里讲清]
音乐:不要任何背景音乐,只生成对应音效   ← 结构化输入时单列,纯叙事 prompt 可省

Shot 01:[机位/景别大白话] + [发生什么]。
Shot 02:……(通常 5~6 个凑够 15s;只编号,不写「0–3 秒」这类时间段)
(≥30s 写成 Shot 01【追问】:… / Shot 02【接受】:…,方括号里是该镜的叙事任务,2–4 字)

约束:[全片锁什么(身份 / 服装 / 机位 / 光向)+ 禁止什么(字幕 / BGM / 提前出现的事件 / 新增人物道具)]

流程分档 / 输出模式 / 时间轴(细则见 references/seedance-director-workflow.md):

  • 分档:≤15s、素材 ≤2 → 轻档,四段填空直接写;16–30s 或素材 3–5 或有台词 → 中档,加素材锁定表和连续性锁;30s+ / 长视频 / 延长 / 编辑 / 白模 / 无缝转场 / 多宫格 / 用户要「导演方案」→ 重档,走全 9 步(锁请求 → 盘素材 → 素材锁定表 → 范例继承 → 专项能力 → 选公式 → 连续性锁 → 起草 → 审)。
  • 输出模式:默认 prompt-only(一个代码块)。用户说「导演方案 / 完整方案」或重档请求 → full-direction:导演方案 → 素材映射表 → 连续性与禁止项 → 最终提示词(唯一代码块)。另有 script-only(只要脚本)、diagnosis-only(只诊断不重写)、revision(按原结构改写,先列改动)。
  • 时间轴模式:默认 Shot 01 / Shot 02;≥30s 默认 Shot 01【阶段功能】。用户明确要精确时间轴 / 卡点 / 第 N 秒 / 长视频 / 延长与编辑的生效秒段 → 改 0-3s【阶段】:动作 + 机位 + 声音 + 结束状态,切片连续不重叠、总和等于时长;长视频按幕 / 场写,不逐秒微操。
  • 标签:素材统一 @Image N / @Video N / @Audio N,按上传顺序编号;用户说「图1」就映射成 @Image 1 并在代码块外注明。

几条硬规则:

  • 机位用大白话(低机位广角 / 侧面跟拍 / 极俯下坠 / 后拉大全景 / 上摇极仰),不套「中文(英文)」术语格式。
  • 每镜只写「镜头运动 + 发生什么」,不堆形容词渲染("晶莹""元气满满""治愈氛围"删掉);叙事复杂时可写长,只要句句是事件不是情绪词。
  • 风格词集中在开头意图行:写媒介 / 画风 / 光影质感(写实纪录片、电影级光影、3D 动画 CG、浅景深、手持呼吸感),一行写完;「8K」「梦幻氛围」「治愈」这类不指向可见画面的词仍删。Shot 行不出现风格词。
  • 不写项目定义行 / 资产绑定独立段 / 场景妆造 / 颜色对撞 / 后期调色;A 节的总纲句压缩成开头一行意图。参考图引用直接内联进主体或镜头行。时长 / shot 数 / 抽卡这类操作信息放代码块外,不进 prompt 本体。
  • 结尾约束行:全片级连续性(身份 / 服装 / 机位 / 光向不变)和禁止项(无字幕 / 无 BGM / 泪水不得提前 / 不新增人物道具)收在最后一行;主体行的负面约束只管单个角色,全片的放这里。轻档一行,中重档可两三行。
  • 主体外形按一致性风险定详略:图清楚、造型简单 → 一句带过;拟人布偶等易被模型画歪的 → 补关键特征 + 负面约束("不能画成真实马 / 人类小孩")。锁一致性不算啰嗦,复述参考图已有的配色 / 布局 / 氛围才算。
  • Shot 只编号不标秒:前缀统一 Shot 01Shot 02(两位数),不写「0–3 秒」「3–6 秒」。单 Shot 时长由 Shot 数量决定;只有用户明确要卡点 / 精确时间轴(2.5)时,才在对应 Shot 里写秒。
  • ≥30s 加阶段功能Shot 01【追问】Shot 02【接受】,方括号里 2–4 字写该镜的叙事任务(登场 / 失衡 / 反转 / 余韵),帮模型分配节奏;≤15s 不加。
  • 事件按因果顺序写:先触发再反应(听到声音→转头;接触→倒下;眼眶先湿→再落泪),结果不能出现在原因之前。
  • 参考素材写清借什么、不借什么参考@Video 1 的动作 不够,写成「Shot 03 参考@Video 1 的起跳—挥砍动作节奏,映射到@Image 1 的角色;不继承@Video 1 的人物 / 场景 / 声音」。
  • 人物参考图默认锁完整可见人物(脸 + 发型 + 服装 + 体型 + 配饰),不继承图里的背景 / 姿势 / 构图;用户说「只参考脸」才缩窄。多主体每人一行、各 @ 自己的图。
  • 有台词按 3–5 字/秒预算,留出听、停顿、反应的时间;塞不下就删词,不压缩表演。

优秀范例(@simonxxoo「莎玛进入缝纫世界」:主体有参考图、场景全新靠文字构建的叙事型):

主体:
莎玛@Image 1 橙色毛绒 pony-like 布偶,灰白条纹帽,牛仔背带裤,圆眼,马脸口鼻,手持画笔,两足站立行走,不能画成真实马或人类小孩。
兔子@Image 2 线圈缝制构成的小兔子 。

Shot 01:
莎玛 站在两张巨大布料幕布拼合成的缝隙门前。幕布中间由一条珊瑚红缝线缝合,红线忽然一针一针松开,布缝里透出温暖白光。空间开始失重,原本竖直的布墙像被旋转了 90 度,变成一片向下打开的布料峡谷。莎玛脚下一滑,被光和红线吸入缝隙深处。

Shot 02:
镜头从极俯快速下坠,莎玛保持两足布偶姿态在空中翻转,身边有纸样、线头、纽扣、布片、缝纫图纸从四周旋转掠过。镜头跟随红线翻滚,红线像导航线一样引导他穿过布料峡谷。

Shot 03:
莎玛落到缝纫世界的地面,先给一个布料纤维地面的特写,毛绒脚落下,柔软纤维轻轻弹起。莎玛慢慢站起来,镜头从他的面部惊讶特写开始,缓慢后拉到从他身后拍摄的大全景。远处是一台巨大缝纫机,像世界地标一样矗立;通往缝纫机的路两边是许多建筑般巨大的线圈,线圈坐落在层层堆叠的牛仔布、奶白棉布、燕麦色布料山丘上,纸样在天空缓慢飘动,整体明亮、宏大、奇幻。

Shot 04:
随后切到莎玛正面中景,他震惊地环顾四周。莎玛背后的线团中,一只由线圈缝制构成的兔子。
线圈兔子突然跳出来,发出轻巧的声音。莎玛听到声音后转头看向它。

Shot 05:
线团兔子灵巧地跳上一只线圈,抬手向上指。镜头跟随它的手势上摇,变成极仰视角,看到高耸线轴塔之间架着由卷尺和红线组成的空中轨道。
线团兔子从轨道上放下一根珊瑚红绳,把绳头叼给莎玛。

Shot 06:
给莎玛一个若有所思的特写,他低头看着手里的红绳,又抬头望向空中轨道。

Shot 07:
最后,莎玛双手抓住红绳,跳上一辆小线车。镜头切到侧向跟拍,小线车沿针脚轨道向前滑行,巨大线轴从前景快速掠过,莎玛进入缝纫世界的连续冒险路线。

看点:① 主体 @Image N 引用 + 负面约束锁住布偶不被画成真人 / 真马;② 场景没有参考图,用文字把「缝纫世界」的地标、尺度、物件讲清(图没覆盖的信息就该写,不违反「别啰嗦」);③ 全程是镜头运动 + 具体事件(红线松开、失重下坠、后拉大全景、上摇极仰、侧向跟拍),没有一个空洞氛围形容词;④ 此范例省了音乐行,实投 Seedance 记得补「不要背景音乐、只出音效」;⑤ 原帖前缀是「镜头N」,此处按本 skill 约定改为 Shot 0N,写法相同;⑥ 原帖无开头意图行和结尾约束行,按现行骨架实投时补两行——开头「毛绒布偶定格动画质感,柔和布料反光,莎玛跌入巨型缝纫世界并踏上冒险」,结尾「约束:莎玛与兔子全程保持布偶材质与服装,红线始终为珊瑚红;无字幕、无 BGM、不新增其他角色」。

抽卡策略:每个 Shot 2~3 秒 → 直出 15 秒能得 ≥5 个连贯且高一致镜头;抽 3 次 = 15 个可选素材。影响单 Shot 时长的是 Shot 数量,不是时间戳。

出稿前自检(6 项):① 每个 @ 都对应用户真给的素材,编号顺序没乱;② Shot 数 × 2~3s ≈ 目标时长;③ 每个 Shot 都是「机位 + 事件」,无氛围形容词、无秒数(≥30s 带【阶段功能】);④ 因果顺序对;⑤ 音效行在(或叙事内已写明只出音效);⑥ 开头一行意图、结尾一行约束都在,约束与 Shot 事件不冲突。

五条反常识(2.0 时代实测;2.5 版本差异见下节注记):

  1. 不放分镜故事板——带运动曲线 / 表格的华丽故事板丢进去反而错漏百出。(2.5 注记:官方新增「多宫格分镜」输入,但推荐的是简约线稿 / 火柴人分镜图,构图 / 景别 / 运镜 / 动作仍靠 Prompt 控制——华丽故事板依旧不要。)
  2. Prompt 别求长——传过主体 / 场景参考图就别文字重复;一段连自己都读不完的 prompt,说明根本没在想故事要发生什么。
  3. Shot 不用时间戳——模型不真按时间戳分配时长,安慰剂。(仅适用 2.0;2.5 官方支持文本时间戳,可精确到秒控制动作演变与场景转场——用 2.5 且用户明确要卡点 / 精确时间轴时,切上面的时间轴模式;默认仍只编号。)
  4. 用 720P,不是 1080P——目前(2026-07)对提示词响应最好,又快又便宜;盲目追高清反而拉垮响应。(2.5 输出档位官方就是 480p / 720p,此条继续成立。)
  5. 清晰度靠后期——定稿后用 Topaz 放大到 4K(注意有的镜头会被过分锐化)。

Seedance 2.0 官方补充(2026-08 官方使用手册;简派与其同代,这里只补硬约束和官方语法,详见 references/seedance-2.0-official.md):

  • 输入上限:图 ≤9 张;视频 ≤3 个、总 2–15s;音频 ≤3 个、总 ≤15s;混合输入总上限 12 个文件——写 prompt 前先确认素材没超限。生成时长 4–15s。
  • ⚠️ 写实人脸拦截:图片 / 视频素材含可辨识真人脸会被系统直接拦截、无法生成——真人质感只能文字描述,不能传照片。
  • 入口只有两个:首尾帧(首帧图 + prompt)/ 全能参考(多模态组合);智能多帧、主体参考不可选。
  • @素材语法:多次 @ 同一素材更准;多主体用编号法「将@Video 1中的小猫作为主体1」防串;音色可单独指定「旁白音色参考@Video 1」;没音频素材可直接参考视频里的声音。
  • 延长 gotcha:「将@Video 1延长 5s」时,生成时长选新增部分的时长(5s),不是总时长。

Seedance 2.5 官方补充(2026-08 官方使用手册;写作手法不变,以下是新的可用空间和官方数字):

  • 时长档位:单次直出最长 30s(duration 4–30s);「超长视频」模式最长 180s;已生成的 ≤30s 视频可多次「套娃」延长,最长到 60s。15s/5–6 镜的抽卡策略照旧,只是叙事长了可以直接要 30s。
  • 输入上限(多模态参考):图片最多 30 张(4K 内);视频最多 10 段、总时长 ≤30s;音频最多 10 段、总时长 ≤30s;支持仅传音频驱动生成(2.0 必须至少有图或视频)。
  • 官方素材建议:参考图 1–5 张效果最好(6–8 张可试但要抽卡);主体图 1–5 个主体单图 / 多视图均可,超过 5 个主体用单视图更稳;要多视角就拆成多张不同视图的图,别塞一张多视角拼图(多图多视图 > 单图多视图);主体音视频 5–10s 效果最好,主体数 1–8 佳;视频编辑的输入片段 ≤20s 效果最好。
  • 音乐铁律更稳了:2.5 大幅修复了随机字幕 / 无关 BGM 乱入,还支持用提示词移除原视频 BGM 只留人声(字幕等画面元素保留)——「只出音效、不要 BGM」这条铁律不变,出货更干净。
  • 可提示能力清单(2.5 写 prompt 时能直接指挥的东西):时间戳卡点、白模控制(用无纹理 3D 白模锁机位 / 站位 / 运动轨迹)、绿幕、局部消除与编辑、空间视角修改(改机位并外推补全画外空间)、两段视频无缝转场补间、迁移创意(复刻参考视频的运动 / 情绪 / 镜头语言 / 网感)、音色参考、多人参考(修复"双胞胎脸")、小语种直写(中文直接写,无需翻译)。
  • 官方场景配方(详见 references/seedance-2.5-official.md,按需取用;≤15s 常规叙事仍默认简派四段填空):
    • 无参考素材 / 通用 → 官方基础公式:素材描述 + 一句话概述 + 分时间轴情节(正向+反向描述)+ 全局补充
    • 要真人脸 / 治 AI 脸、双胞胎脸 → 真人人物 8 维度公式(含「保留真实微细毛孔与肌肤纹理」强制保真后缀)
    • 30s 长视频 → 三模块:多模态参考层 + 全局设定(含禁止项防崩坏)+ 时间戳剧本分镜(物理指令 + 情感潜台词)
    • 60–180s 超长视频 → 开头加全局参数(时长/画幅),其余同基础公式按秒段直写
    • 视频延长 → 必含「向前延长 / 向后延长 / 延续 / 续写」+ 衔接约束;要切镜就套转场公式(官方 11 种转场词库在 reference 里)。「向前 / 向后续写」中文有歧义,先问「新增片段放原片之前还是之后?」;prompt 只描述新增区间并声明原片不变
    • 两段视频无缝转场 → 开头声明「无缝连接@Video 1 与@Video 2,不修改两段原视频」,再写视频1 出点、全屏过渡态、视频2 入点,锁形状 / 位置 / 方向 / 速度
    • 多宫格分镜 → 声明「@Image 1 是 N 格有序完整分镜,每格一个镜头」,角色 / 场景另 @ 图;每格对应一个 Shot
    • 智能编辑 / 高级编辑 / 视频编辑 → [标注工具与方位] + [修改对象] + [动作与变化] + [生效时序]
    • 白模 → 粗颗粒度(动态骨架,5 段公式)/ 细颗粒度(渲染上色,4 段公式);当前粗颗粒度效果更好

simonxxoo 实测心得原文:https://x.com/ring_hyacinth/status/2076284324345987386(@ring_hyacinth 转述,2026-07)。 Seedance 2.5 官方使用手册:https://bytedance.larkoffice.com/wiki/RXh5ww6EqighMdkVTMccm2d4n7e(2026-08-05 摘录其参数 / 素材建议 / 能力清单入上节)。 Seedance 2.0 官方使用手册:《即梦 Seedance 2.0 使用手册(全新多模态创作体验)》官方 docx(2026-08-05 摘录),要点存 references/seedance-2.0-official.md。 导演流程(分档 / 9 步 / 素材锁定表 / 输出模式 / 时间轴模式 / 标签规范):references/seedance-director-workflow.md。 导演手法补充(参考作用域契约 / 人物参考范围 / 因果链 / 台词预算 / 延长方向 / 无缝转场 / 多宫格 / 矛盾自检):references/seedance-direction-patterns.md,吸收自 liyue-aigc/seedance-2-5-video-director(2026-09-04)。

Skills associés