Les outils d'IA générative classiques enferment les créateurs dans une unique zone de texte. Les longs paragraphes descriptifs donnent souvent des résultats imprévisibles, car les modèles peinent à pondérer plusieurs instructions à la fois. BLOCKLORE redéfinit ce processus avec le prompt visuel : décomposer le prompt en nœuds modulaires et interconnectés sur un canevas infini.
En séparant l'intention créative en étapes logiques distinctes, vous gardez un contrôle total sur toute la chaîne de génération. Voici les techniques fondamentales.
1. Prompt modulaire : décomposer la formule
Le prompt visuel consiste à découper une scène complexe en composants distincts, chacun confié à son propre nœud de texte. Plutôt qu'un prompt unique du type « un guerrier médiéval dans une forêt brumeuse, très détaillé, éclairage cinématographique, panoramique lent », les éléments sont séparés : un nœud sujet pour le personnage seul (« un guerrier médiéval en armure de plates »), un nœud environnement pour le décor (« une pinède dense et brumeuse à l'aube ») et un nœud esthétique pour le style et la lumière (« lumière volumétrique cinématographique, esthétique dark fantasy, palette froide »).
En reliant ces nœuds de texte à un même nœud d'image, le modèle traite chaque instruction avec une clarté optimale et produit un résultat bien plus fidèle à l'intention.
2. Chaînes parent-enfant pour la cohérence de style
Maintenir la cohérence visuelle d'une génération à l'autre est l'un des défis majeurs des médias génératifs, et les relations parent-enfant y répondent. Lorsqu'un nœud d'image produit un personnage réussi, il devient le parent. Pour une nouvelle scène avec le même personnage, reliez sa sortie à l'entrée d'un nœud d'image enfant en aval.
Cette liaison transmet les paramètres visuels d'origine comme référence de style directe. Ajoutez au nœud enfant un nouveau nœud de texte pour préciser l'action, par exemple « tenant une épée » : le modèle conserve les traits du visage et le design de l'armure tout en exécutant le nouveau prompt.
3. Workflows séquentiels : du brouillon à la vidéo animée
Le prompt visuel ne s'arrête pas à l'image fixe. Le canevas accueillant aussi des nœuds vidéo, audio et scénario, toute une production se planifie visuellement de gauche à droite : un nœud de scénario pose le storyboard, les mouvements de caméra et la liste des plans ; il alimente un nœud de texte qui génère des variables précises pour chaque plan ; ce nœud alimente un nœud d'image qui compose la scène statique ; l'image passe dans un nœud vidéo où elle est animée avec des contrôles de mouvement précis ; enfin un nœud audio vient superposer un design sonore synchronisé.
Relier les sorties aux entrées suivantes revient à construire un graphe orienté acyclique dans lequel les instructions se propagent automatiquement. Comme chaque génération intermédiaire reste visible en tant que nœud persistant, les variantes se ramifient, se réutilisent et se comparent sans perdre le travail déjà accompli.
4. Éliminer le hasard avec la scène du réalisateur
Le prompt classique laisse le placement de la caméra entièrement au modèle. La scène du réalisateur introduit des prompts visuels spatiaux qui suppriment cet aléa : posez une scène 3D, tracez des mouvements de caméra exacts, comme un travelling compensé ou un panoramique lent, puis transmettez ces paramètres spatiaux aux nœuds de prompt actifs comme contraintes physiques. Le modèle effectue alors le rendu selon ces coordonnées et livre des compositions précises et reproductibles.
Avec le prompt visuel, les créateurs passent de la devinette passive à une orchestration active et structurée. Le canevas infini transforme chaque prompt, chaque référence de style et chaque paramètre d'animation en une brique tangible et connectable, rendant tout le processus plus organisé, plus reproductible et plus puissant.


