圖片生成工具更新於 2026.07.29

圖片導演

不用先學攝影術語,把腦中的畫面變成可以生成與檢查,而且知道怎麼修正的圖片 Prompt。

給想做 AI 圖片,卻不知道怎麼寫 Prompt 的人

把腦中的畫面說清楚,生成不對也知道怎麼改

你只要提供想畫什麼與圖片用途,並說明哪些內容不能被改動。圖片導演會把需求整理成可以直接交給圖片模型的畫面條件。

  • 不用先學攝影術語用一般話描述想法與用途,再補上限制就能開始。
  • 不用讓模型自己猜主體和構圖,以及光線與限制會被逐項說清楚。
  • 不用每次整段重寫圖片不對時,回到造成偏差的欄位修正。
你提供一句想法與用途,或一張參考圖

不必先學會攝影術語,也不需要把需求寫成完整 Prompt。

圖片導演整理主體與空間,以及鏡頭和光線,再加上限制

每一欄只選一個主要方向,避免模型自行猜測優先順序。

你拿到可以生成與解釋,也能修改的輸出

依任務選擇快速 Prompt 或導演規格,也可以使用圖片分析轉 Prompt。

快速 Prompt

方向已經清楚時,把零散描述整理成可直接使用的圖片生成 Prompt。

導演規格

除了 Prompt,也交代景別與角度,並說明構圖和光線如何配合空間關係。

圖片分析轉 Prompt

先拆開參考圖中看得到的特徵,再轉成可重建條件;不確定的資訊不會被寫成事實。

把畫面決定說清楚,再交給模型生成

這套流程把容易混在一起的畫面要求拆成一組可以逐項決定與檢查,而且能持續修正的條件。

適合想用 AI 生成圖片,但不知道怎麼說清楚構圖和角度,也不確定如何交代光線與必要限制的人。你可以從一句想法或簡短需求開始,也可以直接提供參考圖,再依任務選擇需要的輸出深度。

它不靠「更有電影感」這類抽象形容詞,而是明確選擇主體與景別,接著決定角度和構圖,再處理焦點與光線,最後補上必要限制。每一個選擇都要服務原本的畫面目的。

從一句想法到可生成 Prompt

你提供想法與用途,以及參考圖和限制

資料不需要先寫成專業攝影術語。

你拿到快速 Prompt 或導演規格,也可以是圖片分析轉 Prompt

依任務選擇需要的深度,不強迫每次都產生完整報告。

  1. 1
    準備輸入

    提供想畫什麼與圖片用途,再補上尺寸和參考資料,以及不能被改動的內容。

  2. 2
    判斷任務

    確認是從零生成或參考圖生成,也可能是圖片分析或修正既有 Prompt。

  3. 3
    整理條件

    抽出主體與環境,確認用途和風格,再整理必要限制與已知風險,不擅自增加主要設定。

  4. 4
    建立規格

    依序決定景別與角度,接著處理構圖和透視,再安排景深與光線,以及色彩和限制。

  5. 5
    選擇深度

    依需要選擇快速 Prompt 或導演規格,也可以使用圖片分析轉 Prompt。

  6. 6
    組成 Prompt

    先確保畫什麼,再處理怎麼看,最後補上不能失真的條件。

  7. 7
    生成前檢查

    排除互相衝突的鏡頭語言與沒有來源的光線,也去掉多餘限制。

  8. 8
    依結果修正

    指出實際偏差並修改對應欄位,不必把整段 Prompt 全部重寫。

這套方法從哪裡來

圖片導演不是把單一 GitHub Skill 換名後重新發布,而是從三類來源挑出可用部分,再重組成圖片專用的工作流程。

我改了哪些地方

上游資料解決「有哪些詞可以用」,圖片導演接著解決「這一次該怎麼選,而且不能互相打架」。

01
從詞彙清單改成決策流程

先理解圖片用途,再為每個欄位選一個主要方向。

02
把圖片和影片分開

移除運鏡與時間軸,只保留單一畫面能呈現的視覺條件。

03
把事實和解讀分開

先寫參考圖確實看得到的內容,不斷言無法證明的焦段與器材,也不猜測運鏡。

04
用功能語言取代空泛形容詞

把「電影感」轉成可以看見與檢查的角度和空間,再交代光線與明暗關係。

05
避免互相衝突

每次只選一個主要景別與角度,再決定構圖邏輯和透視感,以及光線設計。

06
保留必要限制

人物與產品,以及文字和幾何,還有品牌條件都會明確寫入。

07
不綁單一模型

核心鏡頭語言維持模型中立,特殊語法交給各模型的 adapter。

Prompt 的組裝順序

先確保「畫什麼」,再處理「怎麼看」,最後補上不能失真的條件。

  1. 01主體與可見動作
  2. 02環境
  3. 03景別
  4. 04鏡頭角度
  5. 05構圖與空間關係
  6. 06透視感
  7. 07對焦與景深
  8. 08有來源的光線
  9. 09色彩與質地
  10. 10必要限制

送進模型前,再檢查一次

  • 只有一個主要景別與角度
  • 構圖與透視一致,景深支持同一個重點
  • 光線有合理來源
  • 情緒詞已轉成可見條件
  • 沒有把運鏡寫進單張圖片
  • 沒有擅自加入主要元素
  • 人物與產品正確,文字和品牌限制清楚
  • 負面限制只針對真正可能發生的錯誤

它能做什麼,不能保證什麼

它能把影像決策說清楚,但不保證不同模型產生相同結果。單張圖片也不能證明真實焦段與攝影器材,更不能證明創作者意圖或攝影機運動。

哪些圖片任務適合使用

先說清楚圖片要完成的工作,再決定視覺語言。以下情境都可以直接從簡短需求開始。

社群與文章封面

從主題和版位,以及文字安全區開始,取得可直接生成的封面 Prompt。

海報與活動主視覺

把活動目的與主體層級,以及尺寸限制整理成一致的畫面規格。

產品情境圖

保留產品外觀與比例,同時決定環境和角度,再安排材質與光線。

人物與角色畫面

明確寫下身分特徵與動作,也交代構圖和不可改動的角色條件。

靜態關鍵幀

把分鏡中的某一刻整理成單張圖片能表達的動作與空間關係。

參考圖轉 Prompt

拆出可見特徵與不確定資訊,建立可以重新生成的條件。

取得與版本

已建立固定的 v1.0.0 GitHub 版本。儲存庫與下載連結已公開。