漫剧创作大师
整合四大核心能力,打造从创意到成片的完整 AI 视频创作体系
版本: v1.0
创建日期: 2026-04-08
适用模型: Seedance 2.0、Kie AI Nano Banana Pro、剪映
核心定位
漫剧创作大师 是一个完整的 AI 视频创作体系,整合:
| 模块 | 能力 | 触发词 |
|---|---|---|
| 提示词工程 | 6 段式结构 + 50+ 风格库 | 提示词 / prompt / 生图 |
| 图像生成 | Google 模型 + 多比例 | Kie AI / 生图 API |
| 视频生成 | 6 阶权重 + 角色 DNA | Seedance / 视频生成 |
| 后期剪辑 | 自动化剪辑 + 导出 | 剪映 / 剪辑 |
完整工作流
┌─────────────────────────────────────────────────────────────────────┐
│ 漫剧创作完整工作流 │
├─────────────────────────────────────────────────────────────────────┤
│ │
│ 阶段 1️⃣:创意策划 │
│ ┌─────────────────────────────────────────────────────────────┐ │
│ │ 📝 提示词工程 │ │
│ │ → 6 段式结构 + 50+ 风格库 + 负面词库 │ │
│ │ → 输出:高质量提示词 + 风格方案 │ │
│ └─────────────────────────────────────────────────────────────┘ │
│ ↓ │
│ 阶段 2️⃣:图像生成 │
│ ┌─────────────────────────────────────────────────────────────┐ │
│ │ 🖼️ Kie AI Nano Banana Pro │ │
│ │ → Google 模型 + 10 种比例 + 3 种分辨率 │ │
│ │ → 输出:参考图像 + 角色设定图 + 场景概念图 │ │
│ └─────────────────────────────────────────────────────────────┘ │
│ ↓ │
│ 阶段 3️⃣:视频生成 │
│ ┌─────────────────────────────────────────────────────────────┐ │
│ │ 🎬 Seedance 2.0 │ │
│ │ → 6 阶权重提示词 + 角色 DNA 档案 │ │
│ │ → 输出:电影级视频 + 音频 │ │
│ └─────────────────────────────────────────────────────────────┘ │
│ ↓ │
│ 阶段 4️⃣:后期制作 │
│ ┌─────────────────────────────────────────────────────────────┐ │
│ │ ✂️ 剪映自动化剪辑 │ │
│ │ → 字幕生成 + 音效配乐 + 剪辑节奏 + 导出 │ │
│ │ → 输出:完整成片 │ │
│ └─────────────────────────────────────────────────────────────┘ │
│ │
└─────────────────────────────────────────────────────────────────────┘
触发规则
主触发词
漫剧/漫画剧/AI 视频/视频创作提示词/prompt/生图/图像生成Seedance/视频生成/电影级剪映/剪辑/后期
场景触发
- "帮我创作一个漫剧..."
- "生成一个 AI 视频..."
- "怎么写视频提示词..."
- "角色一致性怎么保证..."
- "后期剪辑怎么做..."
核心能力详解
1️⃣ 提示词工程
6 段式结构:
【固定主控前缀】
NanobananaPro dedicated image generation, (ultra-high quality:1.4),
(masterpiece:1.3), 8K UHD, professional photography, --ar [比例]
【核心主体】
[主体精准描述:外观/服装/姿态/表情]
【场景环境】
[场景精准描述:空间/元素/氛围]
【风格&美学】
[统一风格描述:美学体系/色盘/质感]
【光影&色彩】
[精准光源描述:方向/强度/色温]
【画质&细节】
[相机/镜头参数,渲染引擎,细节要求]
【负面提示词】
ugly, deformed, blurry, [针对性负面词]
风格库分类:
- 电影感风格:写实电影、王家卫、Wes Anderson、诺兰暗黑、赛博朋克
- 艺术风格:油画、水彩、素描、浮世绘、印象派
- 现代风格:极简商业、国潮、蒸汽波、包豪斯、酸性设计
- 二次元风格:日漫、3D 国漫玄幻、美漫、赛璐璐
参考文件: references/style-library.md | references/prompt-templates.md
2️⃣ 图像生成 (Kie AI)
API 端点 (api.heang.top):
POST https://api.heang.top/v1/images/generations
请求格式:
{
"model": "doubao-nanobanana-pro-260103",
"prompt": "图像描述(最长 10000 字符)",
"image_input": [],
"aspect_ratio": "16:9",
"resolution": "2K",
"output_format": "png"
}
参数说明:
| 参数 | 可选值 | 默认值 | 说明 |
|---|---|---|---|
aspect_ratio | 1:1 / 2:3 / 3:2 / 3:4 / 4:3 / 4:5 / 5:4 / 9:16 / 16:9 / 21:9 / adaptive | adaptive | 画幅比例 |
resolution | 480p / 720p / 1080p / 2K / 4K | 1080p | 分辨率 |
output_format | png / jpg | png | 输出格式 |
image_input | URL 数组(最多 8 张) | [] | 参考图片 |
配置:
export KIE_API_KEY="YOUR_API_KEY_HERE"
export HEANG_BASE_URL="https://api.heang.top"
3️⃣ 视频生成 (Seedance 2.0)
API 端点 (api.heang.top):
POST https://api.heang.top/v1/videos/generations
请求格式:
{
"model": "doubao-seedance-2-0-260128",
"prompt": [
{
"shot_id": 1,
"description": "中景,男生在黄昏小巷中行走,暖黄色灯光洒在身上",
"camera_movement": "缓慢推进镜头"
}
],
"references": [
{
"type": "image",
"url": "https://example.com/reference1.jpg",
"weight": 0.8
}
],
"parameters": {
"resolution": "720p",
"fps": 24,
"duration": 10,
"aspect_ratio": "16:9",
"mode": "pro",
"generate_audio": true,
"watermark": false
}
}
模型选择:
- Pro版:
doubao-seedance-2-0-260128(高质量) - Fast版:
doubao-seedance-2-0-fast-260128(快速)
命令系统:
| 命令 | 功能 | 输入 | 输出 |
|---|---|---|---|
/seedance-story | 故事规划 | 主题/类型 | 大纲 + 人物 + 世界观 |
/seedance-character | 角色设定 | 角色名/特征 | DNA 档案 + 参考图提示词 |
/seedance-storyboard | 分镜设计 | 剧本/场景 | 分镜表格 + 镜头列表 |
/seedance-prompt | 提示词生成 | 镜头描述 | 6 阶结构提示词 |
/seedance-generate | 视频生成 | 提示词 + 素材 | 视频 URL+ 音频 URL |
/seedance-project | 完整项目 | 故事创意 | 全套制作方案 |
视频参数:
| 参数 | 说明 | 默认值 |
|---|---|---|
--ratio | 视频比例 | 16:9 |
--duration | 时长 | 强制 10s |
--resolution | 分辨率 | 720p |
--mode | fast / pro | pro |
--watermark | 添加水印 | false |
--generate_audio | 生成音频 | true |
⚠️ 强制规则:每个视频片段必须固定为 10 秒
- 所有单镜头视频生成:
--duration 10 - 分镜脚本中每个镜头:固定 10 秒
- 多片段项目:按 10 秒为单位拆分
- 禁止使用其他时长参数
⚠️ 强制规则:每个镜头必须有台词
- Seedance 支持音画同步,台词会自动生成语音
- 每个镜头的对白/音效列必须有台词内容
- 台词用引号标注,可配合环境音效
- 示例:
"这是...哪里?"或医生:"你活下来了..."
配置:
export SEEDANCE_API_KEY="YOUR_API_KEY_HERE"
export SEEDANCE_BASE_URL="https://api.heang.top"
4️⃣ 后期剪辑 (剪映)
核心功能:
- 素材导入与轨道管理
- 字幕生成与样式设置
- 音效配乐与音画同步
- 特效转场与滤镜
- 项目导出(MP4/SRT)
快速开始:
from jy_wrapper import JyProject
project = JyProject("漫剧项目")
project.add_media_safe("video.mp4", "0s")
project.add_media_safe("audio.mp3", "0s", track_name="Audio")
project.add_text_simple("标题", start_time="1s", duration="3s")
project.save()
导出命令:
python scripts/auto_exporter.py "DraftName" "output.mp4" --res 1080 --fps 60
电影级质量标准
| 指标 | 标准 |
|---|---|
| 分辨率 | 4K 3840×2160(支持 8K) |
| 帧率 | 60fps(关键动作 120fps) |
| 色彩 | Rec.2020 广色域,HDR10+ |
| 光影 | 好莱坞三点布光,体积光,光线追踪 |
| 时长 | 单镜头 4-10 秒(超 10 秒自动分段) |
角色一致性保障
一、角色 DNA 档案
档案包含:
- 外貌特征:发型、发色、脸型、五官、体型、身高
- 服装设计:服装款式、颜色、材质、配饰、鞋子
- 标志性元素:特殊标记、纹身、疤痕、首饰
- 行为习惯:站姿、坐姿、走路姿势、小动作
二、Nanobanana API 一致性控制
核心机制:参考图上传 + 身份锁定
1. 参考图能力
- 最多支持 14 张参考图像(其中 6 张为高保真图像)
- 实现"身份锁定"——将特定人物置于新场景而不变形
- 准确率高达 95% 以上
2. API 调用方式
模型名称:
- Pro 版:
gemini-3-pro-image-preview - 标准版:
gemini-2.5-flash-image-preview
Python SDK 示例:
import google.generativeai as genai
from PIL import Image
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("gemini-3-pro-image-preview")
# 上传参考图建立角色档案
reference_image = Image.open("character_reference.jpg")
# 生成新场景,保持角色一致性
response = model.generate_content([
"保持人物面部特征与参考图完全相同。生成该角色在赛博朋克城市雨夜中行走的场景。",
reference_image
])
3. 身份锁定提示词模板
单角色一致性:
【身份锁定指令】
- 保持人物面部特征与图像 1 完全相同
- 表情/动作:[描述变化]
- 场景:[新场景描述]
- 服装:[可变/保持一致]
多角色一致性:
【输入多张角色参考图】
"创作一个故事,三个角色的服装和形象要保持一致,
但他们的表情和角度在每幅图中要有所变化。
每个角色只能出现一次。"
品牌/IP 一致性:
【输入产品图片】
"请创作 9 张时尚大片,以此为品牌风格参考,
保持产品外观完全一致,但场景和角度变化。"
4. Kie AI API 调用
{
"model": "nano-banana-pro",
"input": {
"prompt": "保持人物面部特征与参考图完全相同。生成该角色在[新场景]。",
"image_input": ["https://example.com/reference1.jpg", "https://example.com/reference2.jpg"],
"aspect_ratio": "16:9",
"resolution": "2K"
}
}
三、一致性保障措施
| 措施 | 方法 | 效果 |
|---|---|---|
| 参考图约束 | 上传 1-6 张高质量参考图 | 身份锚定 |
| 身份锁定指令 | 提示词明确要求"保持特征与图 X 相同" | 语义约束 |
| 角色 DNA 关键词 | 在提示词中强调角色特征(权重 1.5) | 特征强化 |
| 跨镜头锚点 | 使用相同的标志性元素(配饰/纹身) | 视觉连贯 |
四、最佳实践
参考图选择标准:
- 光线均匀、特征清晰
- 正面 + 侧面照各 1 张
- 避免过度滤镜/美颜
- 分辨率不低于 1024×1024
提示词黄金法则:
❌ 差:
"酷车,霓虹灯,城市,夜晚,8k"✅ 好:
"保持人物面部特征与图像 1 完全相同。生成该角色在雨夜东京街道上疾驰的场景,霓虹灯光芒倒映在湿漉漉的路面。"
工作流建议:
1. 建立角色档案
└── 上传 1-6 张高质量参考图
└── 选择光线均匀、特征清晰的正面/侧面照
2. 生成分镜时调用
└── 每次生成都传入参考图
└── 提示词明确要求"保持面部特征与参考图相同"
3. 多场景迭代
└── 场景变化,角色不变
└── 表情/动作可变,身份锁定
五、Seedance 2.0 一致性控制
核心机制:全链路一致性锁定 + Reference-Consistency
1. 一致性能力
| 特征类型 | 锁定内容 |
|---|---|
| 人物 | 脸型、发型、服装、体型 |
| 商品 | 材质、细节、颜色、形状 |
| 镜头 | 运镜、转场风格、光线 |
性能指标:
- 可在长达数十秒视频中保持角色一致
- 人物一致性提升 40% 以上
- 支持多镜头一致性逻辑 (MCCL)
2. 多模态参考输入
| 类型 | 数量限制 | 用途 |
|---|---|---|
| 图片 | 最多 9 张 | 角色/场景参考 |
| 视频 | 最多 3 段 | 运镜/风格参考 |
| 音频 | 支持 | 音画同步 |
| 文字 | 不限 | 提示词描述 |
3. API 调用方式
完整请求体示例:
{
"model": "seedance-2.0",
"prompt": [
{
"shot_id": 1,
"description": "中景,男生在黄昏小巷中行走,暖黄色灯光洒在身上",
"camera_movement": "缓慢推进镜头"
},
{
"shot_id": 2,
"description": "特写,男生抬手整理衣领,背景轻微虚化",
"camera_movement": "固定镜头"
}
],
"references": [
{
"type": "image",
"url": "https://example.com/reference1.jpg",
"weight": 0.8
}
],
"parameters": {
"resolution": "1080p",
"fps": 24,
"duration": 10,
"watermark": false
}
}
4. 一致性提示词模板
人物一致性:
男人@图片1下班后疲惫的走在走廊,脚步变缓,
最后停在家门口,脸部特写镜头...
【语法】@图片1 = 引用参考图
镜头风格一致性:
参考@视频1的所有转场和运镜,一镜到底,
画面以棋局为起始,镜头左移...
【语法】@视频1 = 引用参考视频的运镜风格
商品一致性:
对@图片2的包包进行商业化展示,
包包的侧面参考@图片1,材质参考@图片3...
【语法】多图参考,分别锁定不同特征
5. 参考权重控制
{
"type": "image",
"url": "参考图地址",
"weight": 0.8 // 0-1
}
权重建议:
0.5-0.9:推荐范围- 过高(>0.9):完全复制参考素材
- 过低(<0.5):失去参考意义
6. 注意事项
| 限制项 | 说明 |
|---|---|
| 写实人脸 | 当前不支持上传含有写实人脸的素材 |
| 复杂场景 | 多人物、多场景时偶尔有细节偏差 |
| 收费模式 | 约 0.2 元/秒,高级功能需会员 |
六、Nanobanana vs Seedance 对比
| 特性 | Nanobanana | Seedance 2.0 |
|---|---|---|
| 一致性机制 | 参考图 + 身份锁定指令 | 全链路一致性锁定 |
| 参考图数量 | 最多 14 张 | 最多 9 张图片 + 3 段视频 |
| 多模态 | 图 + 文 | 图 + 文 + 音 + 视 |
| 音画同步 | 不支持 | 原生支持 |
| 一致性准确率 | 95%+ | 40% 提升 |
| 适用场景 | 图像生成 | 视频生成 |
镜头语言体系
10 种基础镜头:
- 推:镜头向前推进,突出主体
- 拉:镜头向后拉远,展示环境
- 摇:镜头水平旋转,跟随主体
- 移:镜头水平移动,平行跟随
- 跟:镜头跟随主体运动
- 升:镜头垂直上升
- 降:镜头垂直下降
- 甩:快速摇镜头,转场效果
- 变焦:焦距变化,放大/缩小
- 旋转:镜头旋转,特殊效果
6 种进阶镜头:
- 第一人称视角(POV):观众视角,沉浸感强
- 俯拍:从上往下,表现渺小
- 仰拍:从下往上,表现高大
- 荷兰角:倾斜镜头,不安感
- 过肩镜头:对话场景
- 蒙太奇:快速剪辑,增强冲击
分镜模板
10 列标准化分镜表格:
| 镜头号 | 景别 | 镜头运动 | 时长 | 画面内容 | 对白/音效 | 备注 |
|---|---|---|---|---|---|---|
| 1 | 特写 | 固定 | 3s | 描述 | 音效 | 备注 |
| 2 | 全景 | 推进 | 5s | 描述 | 对白 | 备注 |
景别分类: 远景 → 全景 → 中景 → 近景 → 特写 → 大特写 → 极端特写
平台适配
| 平台 | 推荐比例 | 时长 | 风格建议 |
|---|---|---|---|
| 抖音 | 9:16 | 15-30s | 强节奏/高饱和 |
| 视频号 | 9:16/1:1 | 15-60s | 商业质感 |
| 小红书 | 3:4/1:1 | 10-30s | 清新/高级感 |
| B 站 | 16:9 | 30s+ | 电影感/二次元 |
| 院线 | 21:9 | 60s+ | 顶级电影质感 |
使用示例
示例 1:单镜头视频(15 秒)
用户:帮我生成一个赛博朋克剑客拔剑的 15 秒视频
AI 输出:
## 🎬 视频生成方案
### 提示词(6 阶权重)
Stage 1: (赛博朋克剑客,黑色机甲战衣,红色能量纹路:1.5)
Stage 2: (拔剑动作,剑身反射霓虹灯光,雨水打在剑刃上:1.3)
Stage 3: (霓虹长安城,雨夜,高楼林立,全息广告牌:1.2)
Stage 4: (中景,缓慢推进,焦点在剑刃:1.1)
Stage 5: (霓虹灯光反射,雨水光泽,色温 6500K:1.0)
Stage 6: (赛博朋克国漫,电影级质感,8K 超高清:0.9)
### 生成命令
/seedance-generate "赛博朋克剑客拔剑..." \
--ratio 16:9 \
--duration 15 \
--watermark false
### 后期建议
- 色彩:冷色调,提升红色能量纹路饱和度
- 音效:拔剑金属声 + 雨声 + 霓虹灯电流声
- 配乐:紧张悬疑的电子乐
示例 2:完整漫剧项目(3 集)
用户:创作一个"机械剑客复仇"的 3 集漫剧
AI 输出:
## 📋 完整项目方案
### 故事大纲
第 1 集:重生(30 秒)- 李玄风从手术台醒来
第 2 集:追踪(45 秒)- 发现仇人线索
第 3 集:对决(60 秒)- 最终决战
### 角色 DNA 档案
**李玄风**
- 外貌:黑色短发,左眼机械义眼(红色),右脸疤痕
- 服装:黑色机甲战衣,红色能量纹路
- 武器:光剑(蓝色能量刃)
- 性格:冷静,果断,重情义
### 分镜表格
[10 列标准化分镜表格]
### 生成命令
/seedance-project "机械剑客复仇" \
--type 武侠/科幻 \
--style 赛博朋克国漫 \
--episodes 3 \
--duration 5
API 配置清单
# 火山引擎 Ark API Key(Seedance 视频生成)
export VOLCENGINE_ARK_API_KEY="your-volcengine-api-key"
# Kie AI API Key(Google 图像生成)
export KIE_API_KEY="your-kie-api-key"
获取地址:
安全红线
绝对不能做
- 生成低俗、暴力、血腥、色情内容
- 生成政治敏感内容
- 泄露用户创意和剧本
- 使用未授权的参考素材
- 忽视角色一致性问题
质量保证
- 必须检查角色一致性
- 必须检查画面质量(无闪烁/无畸变)
- 必须检查剧情连贯性
- 必须检查提示词合规性
参考文件
references/style-library.md- 50+ 大师级风格库references/prompt-templates.md- 分场景提示词模板references/negative-prompts.md- 7 类负面提示词库references/camera-movement-guide.md- 镜头语言体系references/storyboard-template.md- 分镜模板
漫剧创作大师 · 让创意成为电影级视觉盛宴