部落格

視覺提示詞指南:在畫布上編排模組化的 AI 生成

2026-07-03 · BLOCKLORE 團隊

傳統生成式 AI 工具只給創作者一個裝滿文字的輸入框。長段落的描述常常帶來難以預料的結果——模型很難同時權衡這麼多條指令。BLOCKLORE 重新定義了這個過程,導入「視覺提示詞」:把提示詞拆解成一個個模組化、互相連接的節點,擺在無限畫布上。

把創作意圖分解成獨立而清晰的步驟後,你就拿回了對整條生成管線的絕對控制權。以下是幾項基礎技巧。

1. 模組化提示詞:拆開公式

視覺提示詞的核心,是把複雜畫面拆成彼此獨立的成分,每一部分交給專屬的文字節點。與其寫成一句「一位中世紀戰士站在薄霧森林中,高度細節,電影級光照,緩慢橫移」,不如拆開:主體節點只描述角色(「一位身著鐵製板甲的中世紀戰士」),環境節點只描述場景(「黎明時分一片濃密的薄霧松林」),美學節點只描述風格與光線(「電影級體積光,黑暗奇幻風格,冷色調」)。

把這些文字節點分別連到同一個圖片節點上,模型就能以最高的清晰度分別處理每條指令,產出的畫面會更貼近你真正想要的樣子。

2. 用父子鏈保持風格一致

跨多次生成維持視覺一致,是生成式媒體裡最難的問題之一,而父子節點關係正是解法。當某個圖片節點算出令人滿意的角色時,這個節點就成為「父節點」。想讓同一個角色出現在另一個場景裡,把父節點的輸出連到下游子圖片節點的輸入埠即可。

這條連線會把原有的視覺參數往下游傳遞,充當直接的風格參考。再給子節點掛上一個新的文字節點來指定新動作,比如「手持長劍」,模型就會在執行新提示詞的同時,保留角色的臉部特徵與盔甲設計。

3. 串行流程:從草稿到動態成片

視覺提示詞遠不只用於靜態影像。畫布上同樣有影片、音訊與劇本節點,整條製作時間軸都能被視覺化地鋪開,從左到右依序推進:劇本節點先列出分鏡、運鏡與鏡頭表;它連到文字節點,為每個鏡頭生成具體的提示詞變數;文字節點接入圖片節點,算出靜態的場景佈局;產出的影像被送進影片節點,用精確的運動控制讓畫面動起來;最後一個音訊節點接到成片影片節點上,疊加同步的聲音設計。

把節點輸出連到下游輸入,實際上是在搭建一張有向無環圖,提示詞指令會沿圖自動傳播。因為每一次中間生成都作為持久節點留在畫布上,不同版本可以分支、重複使用、並排比較,而不會遺失中途的進度。

4. 用導演台消除隨機性

傳統提示詞把相機位置完全交給模型自行決定。導演台導入了空間層面的視覺提示詞來消除這種隨機:在 3D 場景中擺好姿態,規劃出確切的相機運動(例如推軌變焦或緩慢的電影級橫移),再把這些空間參數作為物理約束送進目前的提示詞節點。模型隨後依照這些座標算圖,交出逐格精確、可重現的構圖。

採用視覺提示詞之後,創作者就從被動的猜測走向主動的結構化編排。無限畫布把每一句提示詞、每一份風格參考與每一個動畫參數,都變成看得見、連得上的構件,讓整個創作過程更有條理、更可重現,也更有力量。

去看模板

更多文章