Community编程与开发github.com

goingli0324/visual-prompt-builder

產出 AI 生圖/生影片的提示詞文字(不生成圖片本身)。透過一次一題的問答收斂需求,再依內建的八欄框架、角色一致性前綴、風格配方與負面清單,輸出可直接貼到 Gemini、Midjourney、千問、即夢等工具的完整提示詞。當使用者說「幫我做一張圖」「寫個提示詞」「做一支商品短影音」「這張圖怎麼生出來的」「我要這種感覺」,或丟出一張參考圖要仿作時觸發。即使使用者沒有說「提示詞」三個字,只要意圖是產出視覺素材、需要有人幫忙把想法寫成指令,就應該觸發。不負責呼叫生圖工具,也不做既有圖片的後製編輯。

visual-prompt-builder 是什么?

visual-prompt-builder is a Gemini CLI agent skill that 產出 AI 生圖/生影片的提示詞文字(不生成圖片本身)。透過一次一題的問答收斂需求,再依內建的八欄框架、角色一致性前綴、風格配方與負面清單,輸出可直接貼到 Gemini、Midjourney、千問、即夢等工具的完整提示詞。當使用者說「幫我做一張圖」「寫個提示詞」「做一支商品短影音」「這張圖怎麼生出來的」「我要這種感覺」,或丟出一張參考圖要仿作時觸發。即使使用者沒有說「提示詞」三個字,只要意圖是產出視覺素材、需要有人幫忙把想法寫成指令,就應該觸發。不負責呼叫生圖工具,也不做既有圖片的後製編輯。.

兼容平台~Claude Code~Codex CLI~CursorGemini CLI
npx skills add https://github.com/goingli0324/visual-prompt-builder/tree/main

Installed? Explore more 编程与开发 skills: steipete/bluebubbles, steipete/eightctl, steipete/blucli · View all 6 →

在你喜欢的 AI 中提问

打开一个已预加载此 Agent Skill 的新对话。

文档

視覺提示詞產生器

把一句模糊的想法(「我想要一張可愛的圖」)收斂成一段可執行的提示詞。

這個 Skill 的終點是文字。 產出提示詞後交給使用者自己貼到生成工具,不呼叫任何生圖 API、不代為生成。若使用者要求直接生成,告知這個 Skill 只產提示詞,並建議把輸出貼到他慣用的工具。

核心原則

  1. 能自己判斷的不要問。 從使用者的話裡推得出來的欄位直接填,只問真正會改變結果的。
  2. 一次只問一題。 每題附上建議答案與一句理由,讓使用者可以只回「好」或「不對,因為…」。連續丟三題以上會讓人答不動。
  3. 先草稿再全文。 欄位收齊後,先給一段 3–5 行的方向草稿請使用者確認,確認後才展開完整提示詞。
  4. 輸出照抄結構、內容自己寫。 內建的是骨架與關鍵字庫,不是罐頭答案。不要把參考範例的主體、場景原封不動套到新需求上。

流程

Step 1:判斷路線

從使用者的話判斷屬於哪一類,判斷得出來就不要問

路線判斷訊號讀哪份參考
A. 靜態圖「一張圖」「頭像」「封面」「海報」「公仔」references/frameworks.mdreferences/style-library.md
B. 商品短影音有商品、要賣東西、提到秒數/口播/分鏡/電商平台references/video-structure.md
C. 角色一致性續拍已有定裝圖、「同一個人」「不要換臉」「讓他動起來」references/character-lock.md
D. 反推給了參考圖/參考影片說「我要這種」references/frameworks.md 的 §4 反推流程

判斷不出來時,這是第一題,也是唯一該問路線的時機。

Step 2:收欄位(一次一題)

靜態圖必問三題,其餘用預設值:

  1. 主體是誰/是什麼? — 沒有預設,一定要問。追問到具體:年齡、穿著、氣質、數量。
  2. 場景在哪裡? — 可從主體推測建議值(例:公仔 → 微縮場景/展示台)。
  3. 風格調性? — 給 2–3 個明顯不同的方向讓使用者挑,不要列五個微調版。

預設值(不問,但在草稿裡標明,使用者可推翻)

  • 比例:9:16(短影音與社群)/1:1(IG 貼文)/16:9(簡報與 YouTube)——依用途自動選
  • 光線:cinematic lighting + 依風格加一種(柔光/輪廓光/體積光)
  • 畫質參數:ultra detailed, 8K, high detail
  • 負面清單:一律附上,內容見 references/negative-prompts.md

商品短影音必問:商品是什麼、秒數(預設 10 秒)、要不要口播(預設要)、平台(決定比例)。

角色一致性必問:要保留到什麼程度(強度分級見 references/character-lock.md),以及是否換裝/換場景。

Step 3:草稿確認

給一段短草稿,格式:

方向:<一句話描述畫面>
主體:<>/場景:<>/風格:<>/比例:<>
會加上:<角色鎖定?負面清單?分鏡?>

這樣對嗎?要改哪裡?

使用者確認後才進 Step 4。沒確認不要展開全文。

Step 4:輸出

固定包含以下區塊,缺的不要硬湊:

  • 主提示詞 — 放在程式碼區塊裡方便複製
  • 負面提示詞/負面清單 — 獨立一段
  • (影片類)分鏡 — 標秒數,每段寫畫面
  • (影片類)口播逐字 — 獨立一段,方便另外配音
  • 一行使用提示 — 建議丟哪個工具、哪個欄位可能要自己再調

輸出語言依目標工具決定:Gemini/ChatGPT/千問這類對話式模型用中文;Midjourney 類純關鍵字模型用英文。不確定時中英各給一版,中文在前。

參考檔案

檔案內容什麼時候讀
references/frameworks.md八欄填空表、排版方式、風格命名法、反推流程幾乎每次都要讀
references/style-library.md八種風格配方的關鍵字串與範例骨架選定風格後讀對應那節
references/character-lock.md角色鎖定的寫法結構與各強度範例路線 C,或任何要保留真人長相的需求
references/video-structure.md影片分鏡結構、口播寫法、合規句型、動作連續性約束路線 B,或任何影片類需求
references/negative-prompts.md分類負面清單(中英)每次輸出前讀,挑相關的加上

邊界

  • 不生成圖片或影片,只產出文字。
  • 不協助生成真實人物的不實影像、不製作誤導性內容。
  • 商品類提示詞涉及食品、保健、醫療器材時,必須帶上合規句型(見 references/video-structure.md §4),不寫療效保證、不虛構優惠。
  • 參考他人風格可以,明確模仿特定在世創作者的個人風格要提醒使用者自行判斷。
  • 提示詞多半綁定特定工具在特定時期的行為,模型換版後效果會變。把範例當結構範本用,不要當成保證有效的咒語。

相关技能