Communitygithub.com

rfdiosuao/Yuhang-ManJu

面向 AI 视频创作的镜头运动、风格库与提示词模板 Skill

Was ist Yuhang-ManJu?

Yuhang-ManJu is a Gemini CLI agent skill that 面向 AI 视频创作的镜头运动、风格库与提示词模板 Skill.

Funktioniert mit~Claude Code~Codex CLI~CursorGemini CLI
npx skills add rfdiosuao/Yuhang-ManJu

In Ihrer bevorzugten KI fragen

Öffnet einen neuen Chat, in dem dieser Agent-Skill bereits geladen ist.

Dokumentation

漫剧创作大师

整合四大核心能力,打造从创意到成片的完整 AI 视频创作体系

版本: v1.0
创建日期: 2026-04-08
适用模型: Seedance 2.0、Kie AI Nano Banana Pro、剪映


核心定位

漫剧创作大师 是一个完整的 AI 视频创作体系,整合:

模块能力触发词
提示词工程6 段式结构 + 50+ 风格库提示词 / prompt / 生图
图像生成Google 模型 + 多比例Kie AI / 生图 API
视频生成6 阶权重 + 角色 DNASeedance / 视频生成
后期剪辑自动化剪辑 + 导出剪映 / 剪辑

完整工作流

┌─────────────────────────────────────────────────────────────────────┐
│                      漫剧创作完整工作流                               │
├─────────────────────────────────────────────────────────────────────┤
│                                                                     │
│  阶段 1️⃣:创意策划                                                   │
│  ┌─────────────────────────────────────────────────────────────┐   │
│  │ 📝 提示词工程                                                 │   │
│  │    → 6 段式结构 + 50+ 风格库 + 负面词库                        │   │
│  │    → 输出:高质量提示词 + 风格方案                            │   │
│  └─────────────────────────────────────────────────────────────┘   │
│                          ↓                                          │
│  阶段 2️⃣:图像生成                                                   │
│  ┌─────────────────────────────────────────────────────────────┐   │
│  │ 🖼️ Kie AI Nano Banana Pro                                    │   │
│  │    → Google 模型 + 10 种比例 + 3 种分辨率                     │   │
│  │    → 输出:参考图像 + 角色设定图 + 场景概念图                 │   │
│  └─────────────────────────────────────────────────────────────┘   │
│                          ↓                                          │
│  阶段 3️⃣:视频生成                                                   │
│  ┌─────────────────────────────────────────────────────────────┐   │
│  │ 🎬 Seedance 2.0                                               │   │
│  │    → 6 阶权重提示词 + 角色 DNA 档案                           │   │
│  │    → 输出:电影级视频 + 音频                                  │   │
│  └─────────────────────────────────────────────────────────────┘   │
│                          ↓                                          │
│  阶段 4️⃣:后期制作                                                   │
│  ┌─────────────────────────────────────────────────────────────┐   │
│  │ ✂️ 剪映自动化剪辑                                             │   │
│  │    → 字幕生成 + 音效配乐 + 剪辑节奏 + 导出                    │   │
│  │    → 输出:完整成片                                           │   │
│  └─────────────────────────────────────────────────────────────┘   │
│                                                                     │
└─────────────────────────────────────────────────────────────────────┘

触发规则

主触发词

  • 漫剧 / 漫画剧 / AI 视频 / 视频创作
  • 提示词 / prompt / 生图 / 图像生成
  • Seedance / 视频生成 / 电影级
  • 剪映 / 剪辑 / 后期

场景触发

  • "帮我创作一个漫剧..."
  • "生成一个 AI 视频..."
  • "怎么写视频提示词..."
  • "角色一致性怎么保证..."
  • "后期剪辑怎么做..."

核心能力详解

1️⃣ 提示词工程

6 段式结构:

【固定主控前缀】
NanobananaPro dedicated image generation, (ultra-high quality:1.4), 
(masterpiece:1.3), 8K UHD, professional photography, --ar [比例]

【核心主体】
[主体精准描述:外观/服装/姿态/表情]

【场景环境】
[场景精准描述:空间/元素/氛围]

【风格&美学】
[统一风格描述:美学体系/色盘/质感]

【光影&色彩】
[精准光源描述:方向/强度/色温]

【画质&细节】
[相机/镜头参数,渲染引擎,细节要求]

【负面提示词】
ugly, deformed, blurry, [针对性负面词]

风格库分类:

  • 电影感风格:写实电影、王家卫、Wes Anderson、诺兰暗黑、赛博朋克
  • 艺术风格:油画、水彩、素描、浮世绘、印象派
  • 现代风格:极简商业、国潮、蒸汽波、包豪斯、酸性设计
  • 二次元风格:日漫、3D 国漫玄幻、美漫、赛璐璐

参考文件: references/style-library.md | references/prompt-templates.md


2️⃣ 图像生成 (Kie AI)

API 端点 (api.heang.top):

POST https://api.heang.top/v1/images/generations

请求格式:

{
  "model": "doubao-nanobanana-pro-260103",
  "prompt": "图像描述(最长 10000 字符)",
  "image_input": [],
  "aspect_ratio": "16:9",
  "resolution": "2K",
  "output_format": "png"
}

参数说明:

参数可选值默认值说明
aspect_ratio1:1 / 2:3 / 3:2 / 3:4 / 4:3 / 4:5 / 5:4 / 9:16 / 16:9 / 21:9 / adaptiveadaptive画幅比例
resolution480p / 720p / 1080p / 2K / 4K1080p分辨率
output_formatpng / jpgpng输出格式
image_inputURL 数组(最多 8 张)[]参考图片

配置:

export KIE_API_KEY="YOUR_API_KEY_HERE"
export HEANG_BASE_URL="https://api.heang.top"

3️⃣ 视频生成 (Seedance 2.0)

API 端点 (api.heang.top):

POST https://api.heang.top/v1/videos/generations

请求格式:

{
  "model": "doubao-seedance-2-0-260128",
  "prompt": [
    {
      "shot_id": 1,
      "description": "中景,男生在黄昏小巷中行走,暖黄色灯光洒在身上",
      "camera_movement": "缓慢推进镜头"
    }
  ],
  "references": [
    {
      "type": "image",
      "url": "https://example.com/reference1.jpg",
      "weight": 0.8
    }
  ],
  "parameters": {
    "resolution": "720p",
    "fps": 24,
    "duration": 10,
    "aspect_ratio": "16:9",
    "mode": "pro",
    "generate_audio": true,
    "watermark": false
  }
}

模型选择:

  • Pro版:doubao-seedance-2-0-260128 (高质量)
  • Fast版:doubao-seedance-2-0-fast-260128 (快速)

命令系统:

命令功能输入输出
/seedance-story故事规划主题/类型大纲 + 人物 + 世界观
/seedance-character角色设定角色名/特征DNA 档案 + 参考图提示词
/seedance-storyboard分镜设计剧本/场景分镜表格 + 镜头列表
/seedance-prompt提示词生成镜头描述6 阶结构提示词
/seedance-generate视频生成提示词 + 素材视频 URL+ 音频 URL
/seedance-project完整项目故事创意全套制作方案

视频参数:

参数说明默认值
--ratio视频比例16:9
--duration时长强制 10s
--resolution分辨率720p
--modefast / propro
--watermark添加水印false
--generate_audio生成音频true

⚠️ 强制规则:每个视频片段必须固定为 10 秒

  • 所有单镜头视频生成:--duration 10
  • 分镜脚本中每个镜头:固定 10 秒
  • 多片段项目:按 10 秒为单位拆分
  • 禁止使用其他时长参数

⚠️ 强制规则:每个镜头必须有台词

  • Seedance 支持音画同步,台词会自动生成语音
  • 每个镜头的对白/音效列必须有台词内容
  • 台词用引号标注,可配合环境音效
  • 示例:"这是...哪里?"医生:"你活下来了..."

配置:

export SEEDANCE_API_KEY="YOUR_API_KEY_HERE"
export SEEDANCE_BASE_URL="https://api.heang.top"

4️⃣ 后期剪辑 (剪映)

核心功能:

  • 素材导入与轨道管理
  • 字幕生成与样式设置
  • 音效配乐与音画同步
  • 特效转场与滤镜
  • 项目导出(MP4/SRT)

快速开始:

from jy_wrapper import JyProject

project = JyProject("漫剧项目")
project.add_media_safe("video.mp4", "0s")
project.add_media_safe("audio.mp3", "0s", track_name="Audio")
project.add_text_simple("标题", start_time="1s", duration="3s")
project.save()

导出命令:

python scripts/auto_exporter.py "DraftName" "output.mp4" --res 1080 --fps 60

电影级质量标准

指标标准
分辨率4K 3840×2160(支持 8K)
帧率60fps(关键动作 120fps)
色彩Rec.2020 广色域,HDR10+
光影好莱坞三点布光,体积光,光线追踪
时长单镜头 4-10 秒(超 10 秒自动分段)

角色一致性保障

一、角色 DNA 档案

档案包含:

  • 外貌特征:发型、发色、脸型、五官、体型、身高
  • 服装设计:服装款式、颜色、材质、配饰、鞋子
  • 标志性元素:特殊标记、纹身、疤痕、首饰
  • 行为习惯:站姿、坐姿、走路姿势、小动作

二、Nanobanana API 一致性控制

核心机制:参考图上传 + 身份锁定

1. 参考图能力

  • 最多支持 14 张参考图像(其中 6 张为高保真图像)
  • 实现"身份锁定"——将特定人物置于新场景而不变形
  • 准确率高达 95% 以上

2. API 调用方式

模型名称:

  • Pro 版:gemini-3-pro-image-preview
  • 标准版:gemini-2.5-flash-image-preview

Python SDK 示例:

import google.generativeai as genai
from PIL import Image

genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("gemini-3-pro-image-preview")

# 上传参考图建立角色档案
reference_image = Image.open("character_reference.jpg")

# 生成新场景,保持角色一致性
response = model.generate_content([
    "保持人物面部特征与参考图完全相同。生成该角色在赛博朋克城市雨夜中行走的场景。",
    reference_image
])

3. 身份锁定提示词模板

单角色一致性:

【身份锁定指令】
- 保持人物面部特征与图像 1 完全相同
- 表情/动作:[描述变化]
- 场景:[新场景描述]
- 服装:[可变/保持一致]

多角色一致性:

【输入多张角色参考图】
"创作一个故事,三个角色的服装和形象要保持一致,
但他们的表情和角度在每幅图中要有所变化。
每个角色只能出现一次。"

品牌/IP 一致性:

【输入产品图片】
"请创作 9 张时尚大片,以此为品牌风格参考,
保持产品外观完全一致,但场景和角度变化。"

4. Kie AI API 调用

{
  "model": "nano-banana-pro",
  "input": {
    "prompt": "保持人物面部特征与参考图完全相同。生成该角色在[新场景]。",
    "image_input": ["https://example.com/reference1.jpg", "https://example.com/reference2.jpg"],
    "aspect_ratio": "16:9",
    "resolution": "2K"
  }
}

三、一致性保障措施

措施方法效果
参考图约束上传 1-6 张高质量参考图身份锚定
身份锁定指令提示词明确要求"保持特征与图 X 相同"语义约束
角色 DNA 关键词在提示词中强调角色特征(权重 1.5)特征强化
跨镜头锚点使用相同的标志性元素(配饰/纹身)视觉连贯

四、最佳实践

参考图选择标准:

  • 光线均匀、特征清晰
  • 正面 + 侧面照各 1 张
  • 避免过度滤镜/美颜
  • 分辨率不低于 1024×1024

提示词黄金法则:

❌ 差:"酷车,霓虹灯,城市,夜晚,8k"

✅ 好:"保持人物面部特征与图像 1 完全相同。生成该角色在雨夜东京街道上疾驰的场景,霓虹灯光芒倒映在湿漉漉的路面。"

工作流建议:

1. 建立角色档案
   └── 上传 1-6 张高质量参考图
   └── 选择光线均匀、特征清晰的正面/侧面照

2. 生成分镜时调用
   └── 每次生成都传入参考图
   └── 提示词明确要求"保持面部特征与参考图相同"

3. 多场景迭代
   └── 场景变化,角色不变
   └── 表情/动作可变,身份锁定

五、Seedance 2.0 一致性控制

核心机制:全链路一致性锁定 + Reference-Consistency

1. 一致性能力

特征类型锁定内容
人物脸型、发型、服装、体型
商品材质、细节、颜色、形状
镜头运镜、转场风格、光线

性能指标:

  • 可在长达数十秒视频中保持角色一致
  • 人物一致性提升 40% 以上
  • 支持多镜头一致性逻辑 (MCCL)

2. 多模态参考输入

类型数量限制用途
图片最多 9 张角色/场景参考
视频最多 3 段运镜/风格参考
音频支持音画同步
文字不限提示词描述

3. API 调用方式

完整请求体示例:

{
  "model": "seedance-2.0",
  "prompt": [
    {
      "shot_id": 1,
      "description": "中景,男生在黄昏小巷中行走,暖黄色灯光洒在身上",
      "camera_movement": "缓慢推进镜头"
    },
    {
      "shot_id": 2,
      "description": "特写,男生抬手整理衣领,背景轻微虚化",
      "camera_movement": "固定镜头"
    }
  ],
  "references": [
    {
      "type": "image",
      "url": "https://example.com/reference1.jpg",
      "weight": 0.8
    }
  ],
  "parameters": {
    "resolution": "1080p",
    "fps": 24,
    "duration": 10,
    "watermark": false
  }
}

4. 一致性提示词模板

人物一致性:

男人@图片1下班后疲惫的走在走廊,脚步变缓,
最后停在家门口,脸部特写镜头...

【语法】@图片1 = 引用参考图

镜头风格一致性:

参考@视频1的所有转场和运镜,一镜到底,
画面以棋局为起始,镜头左移...

【语法】@视频1 = 引用参考视频的运镜风格

商品一致性:

对@图片2的包包进行商业化展示,
包包的侧面参考@图片1,材质参考@图片3...

【语法】多图参考,分别锁定不同特征

5. 参考权重控制

{
  "type": "image",
  "url": "参考图地址",
  "weight": 0.8  // 0-1
}

权重建议:

  • 0.5-0.9:推荐范围
  • 过高(>0.9):完全复制参考素材
  • 过低(<0.5):失去参考意义

6. 注意事项

限制项说明
写实人脸当前不支持上传含有写实人脸的素材
复杂场景多人物、多场景时偶尔有细节偏差
收费模式约 0.2 元/秒,高级功能需会员

六、Nanobanana vs Seedance 对比

特性NanobananaSeedance 2.0
一致性机制参考图 + 身份锁定指令全链路一致性锁定
参考图数量最多 14 张最多 9 张图片 + 3 段视频
多模态图 + 文图 + 文 + 音 + 视
音画同步不支持原生支持
一致性准确率95%+40% 提升
适用场景图像生成视频生成

镜头语言体系

10 种基础镜头:

  • 推:镜头向前推进,突出主体
  • 拉:镜头向后拉远,展示环境
  • 摇:镜头水平旋转,跟随主体
  • 移:镜头水平移动,平行跟随
  • 跟:镜头跟随主体运动
  • 升:镜头垂直上升
  • 降:镜头垂直下降
  • 甩:快速摇镜头,转场效果
  • 变焦:焦距变化,放大/缩小
  • 旋转:镜头旋转,特殊效果

6 种进阶镜头:

  • 第一人称视角(POV):观众视角,沉浸感强
  • 俯拍:从上往下,表现渺小
  • 仰拍:从下往上,表现高大
  • 荷兰角:倾斜镜头,不安感
  • 过肩镜头:对话场景
  • 蒙太奇:快速剪辑,增强冲击

分镜模板

10 列标准化分镜表格:

镜头号景别镜头运动时长画面内容对白/音效备注
1特写固定3s描述音效备注
2全景推进5s描述对白备注

景别分类: 远景 → 全景 → 中景 → 近景 → 特写 → 大特写 → 极端特写


平台适配

平台推荐比例时长风格建议
抖音9:1615-30s强节奏/高饱和
视频号9:16/1:115-60s商业质感
小红书3:4/1:110-30s清新/高级感
B 站16:930s+电影感/二次元
院线21:960s+顶级电影质感

使用示例

示例 1:单镜头视频(15 秒)

用户:帮我生成一个赛博朋克剑客拔剑的 15 秒视频

AI 输出:
## 🎬 视频生成方案

### 提示词(6 阶权重)
Stage 1: (赛博朋克剑客,黑色机甲战衣,红色能量纹路:1.5)
Stage 2: (拔剑动作,剑身反射霓虹灯光,雨水打在剑刃上:1.3)
Stage 3: (霓虹长安城,雨夜,高楼林立,全息广告牌:1.2)
Stage 4: (中景,缓慢推进,焦点在剑刃:1.1)
Stage 5: (霓虹灯光反射,雨水光泽,色温 6500K:1.0)
Stage 6: (赛博朋克国漫,电影级质感,8K 超高清:0.9)

### 生成命令
/seedance-generate "赛博朋克剑客拔剑..." \
  --ratio 16:9 \
  --duration 15 \
  --watermark false

### 后期建议
- 色彩:冷色调,提升红色能量纹路饱和度
- 音效:拔剑金属声 + 雨声 + 霓虹灯电流声
- 配乐:紧张悬疑的电子乐

示例 2:完整漫剧项目(3 集)

用户:创作一个"机械剑客复仇"的 3 集漫剧

AI 输出:
## 📋 完整项目方案

### 故事大纲
第 1 集:重生(30 秒)- 李玄风从手术台醒来
第 2 集:追踪(45 秒)- 发现仇人线索
第 3 集:对决(60 秒)- 最终决战

### 角色 DNA 档案
**李玄风**
- 外貌:黑色短发,左眼机械义眼(红色),右脸疤痕
- 服装:黑色机甲战衣,红色能量纹路
- 武器:光剑(蓝色能量刃)
- 性格:冷静,果断,重情义

### 分镜表格
[10 列标准化分镜表格]

### 生成命令
/seedance-project "机械剑客复仇" \
  --type 武侠/科幻 \
  --style 赛博朋克国漫 \
  --episodes 3 \
  --duration 5

API 配置清单

# 火山引擎 Ark API Key(Seedance 视频生成)
export VOLCENGINE_ARK_API_KEY="your-volcengine-api-key"

# Kie AI API Key(Google 图像生成)
export KIE_API_KEY="your-kie-api-key"

获取地址:


安全红线

绝对不能做

  • 生成低俗、暴力、血腥、色情内容
  • 生成政治敏感内容
  • 泄露用户创意和剧本
  • 使用未授权的参考素材
  • 忽视角色一致性问题

质量保证

  • 必须检查角色一致性
  • 必须检查画面质量(无闪烁/无畸变)
  • 必须检查剧情连贯性
  • 必须检查提示词合规性

参考文件

  • references/style-library.md - 50+ 大师级风格库
  • references/prompt-templates.md - 分场景提示词模板
  • references/negative-prompts.md - 7 类负面提示词库
  • references/camera-movement-guide.md - 镜头语言体系
  • references/storyboard-template.md - 分镜模板

漫剧创作大师 · 让创意成为电影级视觉盛宴

Verwandte Skills