传统生成式 AI 工具只给创作者一个装满文字的输入框。长段落的描述常常带来难以预料的结果——模型很难同时权衡这么多条指令。BLOCKLORE 重新定义了这个过程,引入「视觉提示词」:把提示词拆解成一个个模块化、互相连接的节点,摆在无限画布上。
把创作意图分解成独立而清晰的步骤后,你就拿回了对整条生成管线的绝对控制权。下面是几项基础技巧。
1. 模块化提示词:拆开公式
视觉提示词的核心,是把复杂画面拆成彼此独立的成分,每一部分交给专属的文本节点。与其写成一句「一位中世纪战士站在薄雾森林中,高度细节,电影级光照,缓慢横移」,不如拆开:主体节点只描述角色(「一位身着铁制板甲的中世纪战士」),环境节点只描述场景(「黎明时分一片浓密的薄雾松林」),美学节点只描述风格与光线(「电影级体积光,黑暗奇幻风格,冷色调」)。
把这些文本节点分别连到同一个图片节点上,模型就能以最高的清晰度分别处理每条指令,产出的画面会更贴近你真正想要的样子。
2. 用父子链保持风格一致
跨多次生成保持视觉一致,是生成式媒体里最难的问题之一,而父子节点关系正是解法。当某个图片节点渲染出令人满意的角色时,这个节点就成为「父节点」。想让同一个角色出现在另一个场景里,把父节点的输出连到下游子图片节点的输入端口即可。
这条连线会把原有的视觉参数向下游传递,充当直接的风格参考。再给子节点挂上一个新的文本节点来指定新动作,比如「手持长剑」,模型就会在执行新提示词的同时,保留角色的面部特征与盔甲设计。
3. 串行流程:从草稿到动态成片
视觉提示词远不止用于静态图像。画布上同样有视频、音频与剧本节点,整条制作时间线都能被可视化地铺开,从左到右依次推进:剧本节点先列出分镜、运镜与镜头表;它连到文本节点,为每个镜头生成具体的提示词变量;文本节点接入图片节点,渲染出静态的场景布局;产出的图像被送进视频节点,用精确的运动控制让画面动起来;最后一个音频节点接到成片视频节点上,叠加同步的声音设计。
把节点输出连到下游输入,实际上是在搭建一张有向无环图,提示词指令会沿图自动传播。因为每一次中间生成都作为持久节点留在画布上,不同版本可以分支、复用、并排比较,而不会丢失中途的进度。
4. 用导演台消除随机性
传统提示词把相机位置完全交给模型自行决定。导演台引入了空间层面的视觉提示词来消除这种随机:在 3D 场景中摆好姿态,规划出确切的相机运动(例如推拉变焦或缓慢的电影级横移),再把这些空间参数作为物理约束送进当前的提示词节点。模型随后按照这些坐标渲染,交出逐帧精确、可复现的构图。
采用视觉提示词之后,创作者就从被动的猜测走向主动的结构化编排。无限画布把每一句提示词、每一份风格参考与每一个动画参数,都变成看得见、连得上的构件,让整个创作过程更有条理、更可复现,也更有力量。


