Communitygithub.com

wang-bool/xiaohongshu-storycraft

内容驱动的小红书图文生成 Agent Skill。Turn ideas, drafts, research, screenshots, or photos into complete visual stories without fixed layouts.

xiaohongshu-storycraft とは?

xiaohongshu-storycraft is a Claude Code agent skill that 内容驱动的小红书图文生成 Agent Skill。Turn ideas, drafts, research, screenshots, or photos into complete visual stories without fixed layouts.

対応~Claude Code~Codex CLI~Cursor
npx skills add wang-bool/xiaohongshu-storycraft

お気に入りのAIに質問する

このエージェントスキルを事前に読み込んだ状態で新しいチャットを開きます。

ドキュメント

小红书叙事工坊

把用户的想法、文字和图片制作成可直接发布的小红书图文。交付完整标题、正文、标签、逐页图片和来源说明,不只交付提纲或提示词。

接收与边界

先区分四类材料:

  • 已确认的事实、数据和来源
  • 用户明确表达的经历、感受和判断
  • 图片中能够直接观察到的内容
  • 可以从材料推出的解释和编辑性表达

不把未提供的体验、效果、数字、引语或出处写成事实。关键结论缺少依据时,只问最少的必要问题;用户要求直接制作时,缩小结论范围并明确边界。

用户完全没有提供图片时,只问一次:A 提供自己的照片或截图,默认推荐;B 使用公开图库;C 使用 AI 生成。用户选择后不再重复追问。真实事实、过程和证据优先使用用户材料或可追溯公开来源,纯 AI 图不承担事实证明。

不自动发布到小红书。自动发布需要单独的平台连接、授权和发布确认。

按需读取参考

工作流程

  1. 提取事实、用户经历、图片可见内容和允许补充的解释,形成事实边界。
  2. 规划整组图片叙事,为每页写出唯一页面命题。页面数量由材料和读者任务决定,默认 5–7 页,但不为满足页数重复内容。
  3. 逐张读取真实图片,记录连续比例、焦点、信息密度、最小可读尺寸、完整性要求和叙事角色。
  4. 判断每页由图片还是文字承担不可替代的理解和证明任务,据此建立叙事主位与视觉重量,从内容推导空间关系。不要选择、套用或枚举固定版式。
  5. 选择或定义一部视觉宪法。依次依据用户明确选择、用户描述的感觉,以及内容情绪、读者任务、素材色彩和证据密度判断。只有两个选择会实质改变用户想要的气质且材料无法判断时才询问。风格通过配色和空间气质影响有效构图之间的取舍,但不预设页面骨架。
  6. 把真实图片和真实文字放入 HTML。先让主位内容达到完成任务所需的尺度,再观察实际剩余空间,扩写、压缩、拆分或重组文字。
  7. 通过真实浏览器测量和整页截图复核图片完整性、语义换行、溢出、压边、留白、主次和结束感。
  8. 记录构图指纹并与相邻页面比较。相似没有叙事理由时重新推导;有明确比较或连续节奏作用时可以保留。
  9. 完成事实、来源、隐私和公开发布风险检查后交付。

默认替用户完成判断。材料复杂或页面命题存在多种实质解释时,先确认逐页大纲;普通任务直接生成并在内部迭代。

生成边界

组件只承载标题、正文、图片、图注、数字、引用、边界和来源等语义。组件不得预设跨组件布局。

具体成品和历史案例只能解释某次构图为何成立或失败,不能注册为下一次生成时可选的页面模板、布局算子或配方。

同一份素材允许产生不同构图。同一种构图关系也必须根据真实图片和文字重新计算,不能复制坐标或容器尺寸。

页面与图片底线

每页只承担一个主要阅读任务,并自带理解当前命题所需的上下文。叙事主位依据内容的不可替代性判断,不按面积、字数或素材横竖比预设。

重要图片默认保持主体、文字、关系、证据和必要上下文完整;只有无信息边缘能够安全移除且裁切改善阅读时才裁切。含关键文字、按钮、数据或界面关系的截图不能由 AI 重绘成证据。不强制每页有图,也不强制用完全部图片。

没有来源材料能够承担封面时,可以使用 AI 概念或氛围图,但不能冒充真实产品、地点、人物、体验、测试或结果。可能造成误解时,在视觉资产来源中明确说明。

视觉生成与编辑能力

  • 能看图且能生成或编辑图时,先读取并保留原素材的主体、文字、关系和事实,再进行编辑、整合或受约束再创作。
  • 能看图但不能生成图时,只做裁切、调色、拼图、留白、加字和隐私遮挡;素材不足时用文字页或说明缺口。
  • 既不能看图也不能生成图时,只能交付视觉方案,并明确没有读取、编辑或验证图片,不能声称已经完成发布图片。

用户选择公开图库时,将素材下载到任务素材目录,并在 SOURCES.md 记录“文件名 ← 来源链接”。定稿前列出来源和授权风险,由用户决定公开标注方式。

输出与渲染

默认画布为 1080×1440 或等比例 3:4 竖图。需要精细排版时使用 assets/deck-template.htmlscripts/render_deck.py。简单拼图、加字或隐私遮挡可以使用 PIL。

HTML 页面使用语义标记和检查钩子。关键短语使用 data-phrase-lock,需检查末行的文字使用 data-check-lines,需要完整展示的图片使用 data-preserve-ratio。具体约定见 references/visual-style.md

渲染后必须运行 DOM 检查和 scripts/qa_deck.py,并逐页查看完整截图和 360px 缩略图。自动测量用于发现问题,不能代替审美判断。

交付格式

按以下顺序交付:

## 发布成品

### 标题
[一条最终标题]

### 正文
[可直接复制发布的正文]

### 话题标签
[#标签]

### 图片故事
1. [页面名称]
   - 页面命题 [读者看完本页应理解或判断什么]
   - 图片 [成品文件或明确的降级说明]
   - 图中文字 [本页重点]
   - 事实依据 [用户材料、公开来源或无事实主张]
   - 视觉资产来源 [用户文件、公开素材或 AI 生成]
   - 处理方式/AI 使用 [原图编辑、整合、受约束再创作、纯 AI 补图或具体说明]

### 发布备注
[只有确有用途时提供]

发布前检查

  • 没有虚构事实、体验、效果、数据或来源
  • 标题、正文、图中文字和标签互相一致
  • 每页命题清楚,图片与文字的视觉主次符合该命题
  • 承担现场、动作、结果、证据或关键关系的图片没有被降为长文插图;移除它会破坏页面理解或证明过程
  • 每块文字都提供图片无法表达的新信息;页面空间不足时已经先检查命题过载、图文重复和拆页可能
  • 图片已按真实比例、焦点、细节密度和最小可读尺寸参与构图,没有先塞入预制容器
  • 默认完整展示重要图片;完整性保护有效内容与关系,不机械保留无信息黑边;任何裁切都有可说明的安全区域和叙事理由
  • 公式、数字单位、专有名称和短结论没有发生破坏语义的断行
  • 大面积留白有明确归属和作用;结构性空洞已经从内容关系或构图根因解决
  • 来源、图注和边界说明依附于对应内容,没有漂浮或被挤出画布
  • 已逐页查看真实截图,不只依赖源码或覆盖率数值
  • 已比较相邻页面构图指纹;重复构图具有叙事理由,而非生成习惯
  • 视觉宪法通过配色和空间气质形成识别,没有预设页面骨架或强迫页面重复固定结构
  • 配色保持在所选宪法的色域边界内,角色之间的明度阶梯、彩度秩序和冷暖倾向成立;每个颜色都能说清功能角色,强调色面积稀缺
  • 基底、表面和边线来自同一个中性色家族,正文与弱化信息来自同一个墨色家族;来源、页码和图注在实际承载背景上保持普通小字所需的对比
  • 与最易混淆的相邻风格并排时色域边界一眼可分;重新推导的色值以宪法锚点为色域中心,受到明度、彩度、色温和角色关系共同约束
  • accent 发生明显色相变化时已按完整色组重新校验,不只替换单个强调色;极简黑白等以中性为识别基础的风格继续保持基底无色相
  • 整套只使用一种有内容理由的签名语言;宪法中的点缀候选没有被当成清单累计,拿掉点缀以后页面仍然成立
  • 关键事实图能够追溯到用户原图或具体公开来源
  • 纯 AI 图没有冒充真实内容
  • 已检查人脸、联系方式、证件、精确位置和私人屏幕等公开风险
  • DOM QA 和 PNG QA 没有 FAIL,所有 REVIEW 项均已通过截图判断

関連スキル