Communitygithub.com

CheshireMew/ip-studio

从零创建、锁定并长期复用 IP 角色,自动生成内容视觉与 Codex v2 桌宠

¿Qué es ip-studio?

ip-studio is a Codex agent skill that 从零创建、锁定并长期复用 IP 角色,自动生成内容视觉与 Codex v2 桌宠.

Compatible con~Claude CodeCodex CLI~Cursor
npx skills add CheshireMew/ip-studio

Preguntar en tu IA favorita

Abre un nuevo chat con esta habilidad de agente ya precargada.

Documentación

IP Studio

把零散身份线索或已有角色图变成可跨会话复用的风格化角色,再用同一身份制作社交主页、文章传播视觉和 Codex v2 桌宠。角色创建默认交付正式主参考图、完整角色档案和说明;衍生视觉默认交付经过角色一致性与内容检查的最终图片及可追溯记录;桌宠默认交付九组状态动画、十六个注视方向、完整 QA 证据和可直接安装的宠物目录。用户只做会改变身份、传播方向或既有安装的选择,结构补全、内容提炼、生图、审图、重试、保存、拼装和校验由 Agent 完成。

第一判断

先按用户要得到的独立结果选择主路径:

  • 建立或修改角色身份:从零创建、导入现有形象,或修改已锁定角色,进入“角色身份主路径”。
  • 制作角色衍生视觉:头像、主页横幅、资料卡、文章封面、说明图或正文插图,进入“衍生视觉主路径”。角色身份已有锁定包时直接消费;只有已批准图片时先自动导入并锁定角色;还没有角色时先完成角色身份主路径,再返回当前衍生请求。
  • 制作 Codex 桌宠:把已锁定角色制作、检查、打包或安装成 Codex v2 桌宠,进入“Codex 桌宠主路径”。已有角色包时直接消费;只有已批准图片时先自动导入并锁定角色;还没有角色时先完成角色身份主路径,再返回桌宠请求。

一个请求同时要求角色、衍生图或桌宠时,先锁定角色,再分别完成每个结果;桌宠只能在当前角色版本锁定后开始。普通个人品牌策划、没有 IP 角色参与的一般封面、说明图和插图、照片级数字分身、Codex 桌宠以外的一般动画、Live2D、视频、Windows 独立桌宠和其它桌宠平台停在这里,直接说明相邻能力边界。用户只点名 $ip-studio 时,按从零创建处理。

信息与动作边界

按以下顺序使用信息:

  1. 当前请求和用户明确表达的选择;
  2. 当前对话中已经出现的身份、用途和审美线索;
  3. 用户提供或明确指向的图片、文档、链接与角色文件夹。

角色材料足以决定用途、受众、角色形态、希望留下的印象和最终风格时直接继续。缺少会改变角色方向的信息时,把可行解整理成三张完整方向卡,让用户选择或组合,不发放问卷。用户明确把选择交给 Agent 时,采用最符合用途的一张并说明选择。

衍生视觉先读取当前内容、用户指定的角色包及主参考图,再读取用户提供的 logo、界面、数据或视觉资料。只有事实、名称、品牌方向或核心叙事无法从材料确定,而且不同答案会改变最终图片时,才把一个具体取舍交给用户。平台裁切和安全区需要当前规格且用户没有提供截图或尺寸时,查询该平台官方资料。

桌宠路径先读取当前角色档案和主参考图,再读取用户明确提供的其它形象参考。角色名、桌宠名、风格和动作气质能从角色包稳定推断时直接继续;只有一个固定特征无法同时保持身份与 192×208 桌宠几何时,才把这一个取舍交给用户。除非用户明确要求为一个只有品牌名、没有角色方向的请求补充公开品牌线索,否则不主动联网研究品牌。

调用本 Skill 已授权在当前任务中查看用户提供的图片、使用已有生图与看图能力,并在可写工作区创建角色包、衍生视觉和桌宠运行目录。用户要求“制作可用的 Codex 桌宠”时,写入本机 Codex 宠物目录属于该结果的最后一步;同一宠物标识已经被不同内容占用时,先保存现有目录并请求一次替换决定。其它安装、上传、发送和发布仅在用户另行要求时进行。本流程不删除既有角色版本、正式衍生图、桌宠运行记录或已保存的旧安装。

回复语言跟随用户。内部档案使用固定英文键名,用户不需要阅读或编辑这些键名。

角色身份主路径

先区分从零创建、导入现有形象和修改已锁定角色。导入时区分用户有意保留的特征与当前图片的偶然细节;修改时读取 character-profile.json 及其中登记的单张主参考图,改变固定特征则生成新版本。

进入本路径后读取 references/character-system.md。它负责角色方向、Q 版诊断、生图输入、视觉检查、配色与复杂部件处理;完成每个专业动作后回到本节对应步骤。

1. 建立待确认档案

运行 python scripts/character_kit.py schema 读取当前档案合同。需要文件草稿时运行:

python scripts/character_kit.py draft <draft-profile-path> --character-id <slug> --display-name <name> --language <language>

先把已知信息写入草稿。Q 版方向尚未确定时,允许未选字段暂时为空;正式生图前必须根据用户选择或已认可图片补齐完整重建档案。档案分别记录形体与比例、头脸各部位、躯干与四肢、尾巴或翅膀等附肢、每种颜色的准确落点与面积关系、纹样边界、材质区域、服装层级与连接、标志物的几何和安装方式、正侧背结构、绘制方式和一致性边界。

Agent 主动决定不会改变角色方向的侧面、背面、接缝和材质细节,并在 provenance.decisions 标记为 agent_inferred。会改变轮廓、脸部、主配色、标志物或角色含义的分歧才交给用户。正式生图前运行:

python scripts/character_kit.py prompt <draft-profile-path> --purpose master

该命令先验证档案是否完整,再从档案生成完整身份提示词。后续生图使用命令输出的 prompt;不另写一份身份描述。姿势、动作、场景、画幅和镜头只通过当次命令的 --task 传入。

2. 用 Q 版诊断设计

从同一份待确认档案独立生成三张诊断稿。每张都是单角色、线条清楚、细节克制、约 3.5 头身、正面中性姿态和干净背景;三张应在轮廓、角色形态或核心象征上形成真实差异,而不只是换色。

生成后逐张查看。诊断稿应让主轮廓和一项主要记忆点在缩略图中仍然成立,且没有缺失肢体、结构断裂、无关文字或设计堆积。此时档案仍是暂定设计:只有技术错误或违反用户已经确认的特征才自动淘汰;结构成立、识别清楚但改变了尚未确认细节的图片保留为新分支,并向用户说明变化。某张确实失败时从原档案替换一次,不从失败图片继续编辑。把通过检查的三张图连同简短差异交给用户选择或组合。

已有形象已经获用户认可且用户只要建立档案时跳过本步骤。修改已锁定角色时,只有轮廓、脸部、核心配色或标志物重新设计才回到本步骤。

3. 生成正式主参考图

把用户选择写回待确认档案,逐项补全 reference 规定的结构,再用脚本生成正式候选的完整提示词。通过标准是:另一个 Agent 不需要猜测身份关键细节,就能从档案画出同一个角色的正面、侧面和背面。Q 版只提供本次选择证据,不进入角色包,也不成为后续生图参考。

正式主参考图应是单角色、全身、正面或轻微三分之四视角、中性姿态、干净背景,无文字、标签和拼图;固定特征都能直接看见。先比较档案与图片,再比较技术完整性。明显生成错误自动修正,正式阶段最多修正两次。

基础配色、轮廓、脸部或标志物改变时,从当前档案建立新分支并重画。只有渲染瑕疵可以局部修复;修复后重新检查全部固定特征。同一复杂部件连续两次不正确时,按 reference 中的部件分支先确定它的几何、比例、材质、连接、各视角可见性和运动方式,将获确认的结构写回档案,再由脚本重新生成完整提示词和整张角色图。

向用户展示通过检查的正式候选并请求最终批准。用户已经在当前请求中明确授权 Agent 代为定稿时,Agent 可选择最符合档案的一张。

4. 验证可复用性

最终稿获批后,先核对图中实际成立的结构与档案:用户已批准的设计变化写回对应字段,偶然生成细节不反向覆盖已确认设定。然后运行:

python scripts/character_kit.py prompt <draft-profile-path> --purpose consistency --reference <approved-master-image> --task <different-pose-expression-and-simple-background>

把命令输出的 promptmaster_reference 一起交给生图能力,生成一张不同姿势、不同表情、简单背景的一致性测试图。测试图必须保留形体、脸部、颜色落点、服装连接、材质和标志物;它只用于本次检查,不写进角色包,也不作为后续参考。

测试不通过时先判断是档案描述缺失还是主参考图不稳定,再更新对应生产者并重试;最多修正两次。仍需放弃一个已批准特征时,把这个取舍交给用户决定。

5. 无损锁定角色包

角色通过一致性检查后,在当前可写工作区使用 ip-studio-output/<character-slug>/。将待确认档案和正式主图交给脚本:

python scripts/character_kit.py finalize <kit-folder> --profile <draft-profile-path> --master <master-image-path>
python scripts/character_kit.py check <kit-folder>

finalize 在写入前验证档案和图片;已有角色会递增版本,把旧档案与说明保存进 history/rNNN/,并保留旧主图。命令失败时读取错误、修正生产输入后重试,不手写脚本本应生成的版本号、校验值或说明文件。

脚本成功后重新读取 character-profile.jsoncharacter-guide.md,实际打开 assets.master_reference 指向的图片,并运行一次 python scripts/character_kit.py prompt <kit-folder> --purpose scene --task <simple-reuse-task> 确认下游能够读取当前档案与主图。只有档案、说明、图片和派生提示词一致且 check 通过,才算角色已经锁定。

衍生视觉主路径

本路径只消费已经锁定的角色身份。读取 references/visual-production.md,它负责头像、主页横幅、资料卡、文章封面、说明图和正文插图的简报、构图、生图、检查与归档;完成每个专业动作后回到本节。

1. 确定本次结果

把请求拆成一个或多个明确结果:

  • avatar:同时适配圆形与方形裁切的 1:1 头像;用户说“头像套图”时分别生成简化徽章版与丰富肖像版。
  • profile-banner:未指定平台时使用 3:1 通用主页横幅;指定平台时按实际裁切与遮挡区构图。
  • profile-card:默认 4:5 手机端资料卡。
  • cover:固定 5:2 文章封面。
  • explainer:按内容在 4:53:416:9 中选择说明图比例。
  • article-illustration:固定 16:9 正文插图。

用户说“主页套图”时默认生成头像与主页横幅,明确要求资料卡时再加入资料卡。每个结果分别建立简报、生成、检查和归档,共享同一角色版本;一个结果不借用另一个结果的候选图继续衍生。

2. 建立视觉简报

先运行 python scripts/visual_kit.py schema,再由 Agent 创建并填写草稿:

python scripts/visual_kit.py draft <brief-path> --kind <kind> --visual-id <slug> --language <language>

根据内容真源确定核心对象、理解缺口、机制或变化、看后结论、品牌角色、唯一主要结构、角色动作、标题、标签和配色。封面、说明图和正文插图按 references/visual-production.md 的当前合同执行。

角色必须在内容视觉中承担因果动作:亲自接收、移动、连接、拆分、选择、阻挡、转换或承受核心对象,并产生可见结果。头像以缩略图识别为目标;主页横幅和资料卡让角色与核心符号发生真实互动。用户不需要查看或编辑简报。

3. 生成并自动检查

运行:

python scripts/visual_kit.py prompt <kit-folder> --brief <brief-path>

把命令输出的 prompt 和按序排列的 image_references 一起交给生图能力。它们分别来自当前角色档案、单张主参考图、视觉简报和用户提供的其它图片,不另写第二份角色身份或内容提示词。

生成后实际打开图片,按 reference 的顺序检查角色一致性、内容事实、角色动作的因果作用、唯一信息结构、手机端层级、文字与 logo 可辨认性和技术完整性。失败时修正最早出错的简报判断,再从原始角色档案与内容资料重画;每张正式结果最多自动修正两次。仍需改变事实、叙事重点或角色固定特征时,只把这一项取舍交给用户。

4. 归档最终图片

用户批准或已授权 Agent 代为定稿后运行:

python scripts/visual_kit.py finalize <kit-folder> --brief <brief-path> --image <approved-image>
python scripts/visual_kit.py check <visual-folder> --kit <kit-folder>

正式结果写入 <kit-folder>/derivatives/<kind>/<visual-id>/。其中保存最终图片、视觉简报、当次角色档案快照、完整生图输入、输入资料副本和校验记录;当前角色档案、主参考图和历史版本保持不变。候选图、自动重试图和一致性检查材料只留在任务临时目录。

脚本成功后重新读取 visual-record.json,实际打开其中登记的最终图片,并确认角色版本、主参考图、视觉简报、生图输入和最终图片的校验值均可读取。满足当前请求后停止,不自动扩展成其它比例、表情包或媒体。

Codex 桌宠主路径

本路径只消费已经锁定的角色身份。进入后读取 references/pet-production.md;它负责 Codex v2 精灵表合同、九组状态、十六个方向、逐行生图、确定性拼装、盲审、动态预览、成品目录和安装。角色身份、升版和其它衍生视觉仍由各自主路径负责。

开始时建立四步可见进度,并在真实文件或决定存在后才推进:

  1. 准备角色和桌宠运行目录。
  2. 生成桌宠尺寸下的主形象。
  3. 生成并检查全部动作与注视方向。
  4. 拼装、验证并安装桌宠。

1. 建立与角色包相连的运行目录

先调用工作区依赖加载器,把它返回的 Python 绝对路径用于本路径的每条命令。运行:

"<workspace-python>" -B scripts/pet_kit.py schema
"<workspace-python>" -B scripts/pet_kit.py prepare <kit-folder>
"<workspace-python>" -B scripts/pet_kit.py check <run-folder> --stage prepared

prepare 从当前 character-profile.json 生成桌宠尺寸下的完整身份描述,复制角色档案、说明和单张主参考图的可校验快照,并生成基础图、九组动作、四向锚点和两条方向行的正式任务。默认在 <kit-folder>/derivatives/codex-pet/<pet-id>/runs/rNNN/ 建立新运行,不覆盖旧运行。尾巴灯笼等独立配件继续保持独立与可摆动,同时让固定点、箍环、吊带、圆环和配件之间的受力路径在 192×208 中连续可见。

2. 生成桌宠主形象和标准动作

生图前完整加载当前环境的 $imagegen Skill。运行 pet_kit.py ready <run-folder>,只处理返回的 ready_jobs。每个任务读取 imagegen-jobs.json 登记的提示词和全部图片输入;基础图可以只由角色包开始,其它行必须附带角色主参考图、桌宠主形象和对应布局参考。

选定结果后实际打开图片,再运行:

"<workspace-python>" -B scripts/pet_kit.py accept-job <run-folder> --job <job-id> --source <image> --qa-note <visible-evidence>

该命令把通过的结果写入正式位置、执行该阶段的确定性检查并更新依赖。基础图通过后生成 idle、左右移动、招手、跳跃、失败、等待、任务运行和检查结果九组动画;每组使用 reference 规定的帧数和应用语义。彼此独立的动作行可在环境允许时最多并行生成三个,用户不需要调度任务。

左右翻转不改变脸纹、光向、单侧配件和标志物含义时,running-left 可用 reference 指定的逐格镜像脚本从已批准的 running-right 得到;其它状态分别生成。九组动作通过后,按 reference 生成 8×9 中间精灵表、总览图和九个 GIF,实际看图检查身份、状态、方向、循环、尺度和连接。

3. 生成十六个注视方向

Agent 根据角色头脸、眼睛、身体、附肢和配件的真实构造写入 qa/look-mechanics.md,确定固定锚点、谁引导视线、谁跟随、每个方向的遮挡和每 22.5 度运动幅度。先生成并批准上、屏幕右、下、屏幕左四向锚点,再生成第 9 行和第 10 行两个完整八格方向族。

方向行从批准的四向姿态均匀插值;第 10 行同时读取已完成第 9 行,保证跨行连接。单个方向失败时重做它所在的完整八格行,不把独立修补格混进最终精灵表。accept-job 会用同一尺度、下身锚点和基线注册方向行,并在进入下一阶段前检查正式格子边缘。

若已接受的动作或方向在后续总览、GIF、连续性检查或盲审中失败,用原 accept-job 命令增加 --replace-complete 接受替换图。脚本会把被替换任务、依赖它的后续任务和失效产物一并移入版本化历史,再从最早失败点继续;不要手改任务状态或沿用旧图集。

4. 最终检查、成品和安装

方向行完成后,按 reference 对完整 8×11 精灵表只执行一次边缘去幕布色,再依次运行 v2 尺寸与透明检查、标准与最终总览、九个 GIF、十六方向图、相邻连续性测量和三份隔离方向盲审。独立最终看图结果与每个方向的可见证据写入 reference 规定的 QA 文件;四个正方向、角色身份、配件连接、动作状态和精灵表几何全部通过后才能定稿。

运行:

"<workspace-python>" -B scripts/pet_kit.py finalize <run-folder>
"<workspace-python>" -B scripts/pet_kit.py check <run-folder> --stage final
"<workspace-python>" -B scripts/pet_kit.py install <run-folder>

finalize 重新读取角色快照、十三个视觉任务、确定性报告和看图结论,然后生成只含 pet.jsonspritesheet.webp 的正式宠物目录。install 把它写入当前 Codex 宠物目录;相同内容已经存在时不重复写入,不同内容占用同一标识时回到“信息与动作边界”处理替换决定。安装完成后不代替用户重启应用或点击设置开关。

工具缺失时

角色身份路径没有生图能力时,完成方向选择和完整待确认档案,运行 character_kit.py prompt --purpose master 并交付其结果,明确说明图片与角色包尚未完成。

衍生视觉路径没有生图能力时,完成视觉简报并运行 visual_kit.py prompt,交付已完成的传播判断和生图输入,明确说明最终图片与衍生归档尚未完成。没有可写工作区时可以展示图片和说明,但聊天中的结果尚未形成可携带角色包或可校验的衍生目录。

桌宠路径没有生图能力时,完成 pet_kit.py prepare,交付已连接角色包的运行目录、完整任务图和第一条基础图提示,明确说明动作图、精灵表和安装尚未完成。没有独立看图执行能力时,完成所有确定性检查后只把方向盲审图和最终总览交给用户确认,不伪造三份盲审或独立最终结论。

交付与停止

角色身份路径第一段直接说明角色是否已经锁定。完成时展示正式主参考图,并说明核心记忆点、当前版本和角色包绝对路径;随后列出可选衍生方向,但只继续完成用户当前点名的结果。

衍生视觉路径第一段直接说明图片已经完成或还缺什么。完成时先展示每张最终图片,再用一句话说明它表达的核心关系、使用的角色版本和绝对保存路径。用户不需要复制提示词、编辑 JSON、手动编号、建立分支或整理图片。

桌宠路径第一段直接说明桌宠是否已经生成并安装。完成时先展示最终总览图和至少一个动作预览,再说明宠物名、所用角色版本、九组状态与十六方向是否通过、正式成品目录和安装绝对路径;最后只提醒用户重启或重新打开 Codex,并在设置中启用宠物。

完成标准是:

  • 角色包包含当前档案、说明、单张主参考图和可读取的历史版本,Q 版诊断稿与一致性测试图没有成为长期参考;
  • 衍生图读取了角色包的真实生产结果和用户内容,角色身份与传播关系都通过实际看图检查;
  • 每个正式衍生目录能重新验证角色版本、视觉简报、生图输入、输入资料和最终图片;
  • 桌宠运行目录能重新验证角色快照、主参考图、十三个视觉任务、九组动作预览、十六方向语义、盲审、透明处理、v2 精灵表和正式宠物目录;
  • 衍生图和桌宠没有反向改变角色身份,未点名的其它视觉、动画或平台版本也没有自动生成。

Skills relacionados