Blog

Visual-Prompt-Guide: modulare KI-Generierungen auf der Canvas dirigieren

2026-07-03 · BLOCKLORE-Team

Klassische generative KI-Tools sperren Kreative in ein einziges, textlastiges Eingabefeld. Lange beschreibende Absätze führen oft zu unvorhersehbaren Ergebnissen, weil Modelle viele Anweisungen nur schwer gleichzeitig gewichten. BLOCKLORE definiert diesen Prozess mit Visual Prompting neu: Der Prompt wird in modulare, miteinander verbundene Nodes auf einer unendlichen Canvas zerlegt.

Indem die kreative Absicht in einzelne, logische Schritte zerfällt, bekommst du die volle Kontrolle über die Generierungs-Pipeline. Hier sind die grundlegenden Techniken.

1. Modulares Prompting: die Formel zerlegen

Visual Prompting beruht darauf, eine komplexe Szene in klar getrennte Bestandteile zu zerlegen und jedem einen eigenen Text-Node zu geben. Statt eines einzigen Prompts wie "ein mittelalterlicher Krieger in einem Nebelwald, hochdetailliert, filmisches Licht, langsamer Schwenk" werden die Elemente getrennt: ein Subjekt-Node nur für die Figur ("ein mittelalterlicher Krieger in eiserner Plattenrüstung"), ein Umgebungs-Node für den Schauplatz ("ein dichter, nebliger Kiefernwald im Morgengrauen") und ein Ästhetik-Node für Stil und Licht ("filmisches volumetrisches Licht, Dark-Fantasy-Ästhetik, kühle Farbpalette").

Verbindest du diese Text-Nodes mit einem einzigen Image-Node, verarbeitet das Modell jede Anweisung mit maximaler Klarheit, und das Ergebnis trifft die kreative Vorstellung deutlich genauer.

2. Eltern-Kind-Ketten für konsistenten Stil

Visuelle Konsistenz über mehrere Generierungen hinweg gehört zu den größten Herausforderungen generativer Medien, und Eltern-Kind-Beziehungen lösen sie. Liefert ein Image-Node ein gelungenes Charakterbild, wird dieser Node zum Elternteil. Für eine neue Szene mit derselben Figur verbindest du seinen Ausgang mit dem Eingang eines nachgelagerten Kind-Image-Nodes.

Die Verbindung reicht die ursprünglichen visuellen Parameter weiter und wirkt als direkte Stilreferenz. Häng an das Kind einen neuen Text-Node für die neue Handlung, etwa "hält ein Schwert", und das Modell bewahrt Gesicht und Rüstungsdesign, während es den neuen Prompt ausführt.

3. Sequenzielle Workflows: vom Entwurf zum animierten Video

Visual Prompting endet nicht beim Standbild. Da auf der Canvas auch Video-, Audio- und Script-Nodes leben, lässt sich eine ganze Produktion von links nach rechts visuell planen: Ein Script-Node skizziert Storyboard, Kamerabewegungen und Shotliste; er führt zu einem Text-Node, der pro Einstellung konkrete Prompt-Variablen erzeugt; der Text-Node speist einen Image-Node, der das statische Szenenlayout rendert; das Bild wandert in einen Video-Node, wo es mit präzisen Motion-Controls animiert wird; und ein Audio-Node ergänzt am Ende synchrones Sounddesign.

Ausgänge mit nachgelagerten Eingängen zu verbinden heißt, einen gerichteten azyklischen Graphen zu bauen, durch den die Prompt-Anweisungen automatisch fließen. Weil jede Zwischenstufe als dauerhafter Node sichtbar bleibt, lassen sich Varianten verzweigen, wiederverwenden und nebeneinander vergleichen, ohne Fortschritt zu verlieren.

4. Zufall ausschalten mit der Director Stage

Beim klassischen Prompting bleibt die Kameraposition ganz dem Modell überlassen. Die Director Stage bringt räumliche visuelle Prompts ins Spiel und nimmt diesen Zufall heraus: Stelle eine 3D-Szene, plane exakte Kamerabewegungen wie einen Dolly-Zoom oder einen langsamen filmischen Schwenk und gib diese räumlichen Parameter als physische Vorgaben an die aktiven Prompt-Nodes weiter. Das Modell rendert dann nach genau diesen Koordinaten und liefert framegenaue, wiederholbare Kompositionen.

Mit Visual Prompting wechseln Kreative vom passiven Raten zur aktiven, strukturellen Inszenierung. Die unendliche Canvas macht jeden Prompt, jede Stilreferenz und jeden Animationsparameter zu einem greifbaren, verbindbaren Baustein und den gesamten Prozess damit geordneter, wiederholbarer und kraftvoller.

Vorlagen ansehen

Mehr aus dem Blog