Un agent, un serveur MCP, 244 tirages

La refonte visuelle de Dynasty Nova, le jeu de gestion spatiale par navigateur que je développe, a été produite d'une façon qui aurait semblé exotique il y a un an. Elle a été pilotée par un agent IA, Claude Code, qui appelait directement les outils du serveur MCP de Krea. Pas de script lancé à la main, pas d'interface web. L'agent composait les prompts et téléversait les références. Il lançait quatre tirages par entité, rangeait les résultats et préparait le choix.

Sur les 61 entités du jeu, cela représente 244 tirages. Cet article ne parle pas de la qualité des images (c'est l'objet des articles précédents de la série), mais de l'organisation : ce qu'on confie à un agent, ce qu'on lui interdit, et comment on l'écrit pour que ça tienne.

Pourquoi le MCP plutôt qu'un script

Le Model Context Protocol permet à un agent d'utiliser des outils externes comme il utiliserait une commande. Si le principe vous est nouveau, notre guide des agents et du MCP dans Figma le détaille côté design d'interface.

L'accès au compte

Le serveur MCP de Krea s'authentifie en OAuth au nom du compte, et voit donc ses styles privés. Une clé d'API, elle, ne les voyait pas dans nos essais : la lecture d'un style privé renvoyait une erreur 404. Pendant les versions précédentes, qui utilisaient un style entraîné, c'était décisif.

Le crédit

Autre différence bien réelle : le solde de l'API Krea est séparé du solde de calcul de l'espace de travail. Une clé d'API peut se retrouver sans crédit alors que le compte en a. Le MCP, lui, consomme le solde du workspace.

Les outils réellement utilisés

  • get_upload_url → une adresse de dépôt valable trois heures, pour téléverser une référence.
  • generate_image → toutes les générations, Krea 2 comme Nano Banana Pro.
  • get_job → le suivi d'un job asynchrone jusqu'à son statut « completed ».
  • enhance_image → l'agrandissement final, une fois par variante retenue.

Le partage des rôles, écrit noir sur blanc

Un agent qui génère des images peut aussi les choisir, les écraser, les renommer ou les pousser en production. La première chose écrite n'a donc pas été un prompt, mais un ensemble de règles, rangées dans une compétence (un « skill ») que l'agent charge avant toute campagne.

Schéma : l'agent IA compose, téléverse, tire quatre variantes et mesure ; l'auteur choisit, fixe la direction artistique, étalonne et verse en production
Le partage des rôles : l'agent produit et mesure, l'auteur décide.

Les cinq règles

  1. La production ne bouge jamais : une image retenue s'écrit dans une version de travail, jamais à la place du visuel en jeu.
  2. Tout rejet est conservé, avec la porte qui l'a écarté : les rejets sont la condition pour mesurer le taux de réussite.
  3. La grille ne change pas en cours de campagne : sinon les chiffres ne se comparent plus.
  4. Rien hors du périmètre prévu : l'agent ne touche pas au reste du jeu.
  5. Les mesures écartent, elles ne choisissent pas : le choix appartient à l'humain.

La version est un paramètre, jamais une supposition

Une campagne remplit une version de la direction artistique, elle n'en crée pas une. Le nom de la version est donné par l'humain, jamais deviné par l'agent. Le piège est concret : lancée sans version, la campagne repartait des prompts de production, c'est-à-dire de l'ancien style.

Un lot pilote avant toute série

Une version qui change de direction artistique commence par un lot pilote : une entité par famille, chaque piste tirée séparément, présentées côte à côte. Pour la refonte, ce rôle a été tenu par trois entités sur trois climats, validées le même jour, avant le passage aux 61.

Une machine à états entre l'agent et les scripts

La campagne s'appuie sur un petit outil en ligne de commande qui ne génère rien lui-même : il planifie et mesure, l'agent produit.

  • plan → ouvre la campagne pour une version, une famille ou une liste d'entités, avec un lot (4 par défaut) et un plafond de tours.
  • ingest → applique les portes automatiques à chaque tirage et rend un verdict par entité : recevable, à relancer ou épuisée.
  • status → le taux de tirages recevables avec son intervalle de confiance, les rejets par porte, le coût projeté.
  • simuler → un test à vide, sans dépenser de crédit.

L'agent boucle tirage puis mesure sans rien demander, jusqu'à « rien à tirer » ou au plafond de tours. L'humain n'est sollicité que pour ce qui lui revient.

La traçabilité, gratuite

Pour chaque entité, le prompt envoyé et la référence utilisée sont consignés dans un fichier de version, à côté du numéro de la variante choisie. Six mois plus tard, on sait exactement comment chaque image a été obtenue, et on peut la régénérer.

Les pièges, pour vous les éviter

Aucun n'est spectaculaire. Tous ont coûté du temps.

  • WebP refusé en référence → convertir en PNG, redimensionné à 1 024 de large.
  • Liens d'assets de l'app web → une page authentifiée, illisible par l'agent : il faut déposer le fichier lui-même.
  • Boucle de téléversement en arrière-plan → elle peut se bloquer sans erreur alors que chaque appel réussit seul : la lancer au premier plan.
  • Interroger un job MCP par l'API REST → « Job not found » même pour un job réussi : rester sur l'outil de suivi du MCP.
  • Agrandissement → le facteur et les dimensions demandées se multiplient : 2 048 × 2 048 avec un facteur 2 ressort en 4 096 × 2 048.
  • Dimensions au-delà du budget → sur Flux 1 Dev, demander du 2 048² ne renvoie pas d'erreur mais recompose l'image en 1 584 × 672.

Ce que ça change pour un designer

Travailler avec un agent ne supprime pas le travail de direction artistique : il le déplace. Moins de temps à cliquer « générer » et à renommer des fichiers, plus de temps à écrire des règles, à choisir les références et à trancher entre quatre variantes. C'est la même évolution que décrit notre article sur les compétences IA du designer en 2026, appliquée à la production visuelle.

Écrire pour un agent, c'est écrire pour un collègue

Les règles qui ont le mieux fonctionné sont celles qu'on écrirait pour un stagiaire brillant mais sans contexte : explicites, justifiées, avec l'erreur qu'elles évitent. Une règle sans son « pourquoi » finit toujours par être contournée au premier cas limite.

Conclusion

Un agent IA n'est pas un générateur d'images plus rapide. C'est un chef de production qui applique une méthode, à condition que la méthode soit écrite. Sur Dynasty Nova, cette organisation a permis de produire 244 tirages traçables, et de garder chaque décision de goût entre les mains de l'auteur. Pour situer cette pratique dans le paysage plus large, voir notre guide de l'IA en design et notre présentation de Krea.ai.

Dans la même série

Questions fréquentes

Peut-on faire générer des images par un agent IA via MCP ?
Oui. Le serveur MCP de Krea expose des outils de génération, de téléversement de références, de suivi de job et d'agrandissement. Un agent comme Claude Code peut les appeler directement, en s'authentifiant au nom du compte Krea.
Quelle différence entre l'API Krea et le serveur MCP Krea ?
Le serveur MCP s'authentifie en OAuth au nom du compte et voit ses styles privés, là où une clé d'API ne les voyait pas dans nos essais. Le crédit est aussi distinct : le solde de l'API est séparé du solde de calcul de l'espace de travail.
Que faut-il laisser à l'humain dans une chaîne de génération d'images pilotée par IA ?
Tout ce qui relève du goût : le choix de la variante retenue, la direction artistique, l'étalonnage final et la mise en production. L'agent compose, génère, range et mesure ; les mesures écartent les images inutilisables mais ne choisissent jamais.
Quels formats d'image utiliser comme référence dans Krea ?
Dans nos essais, le WebP n'a pas été accepté comme référence : nous convertissons en PNG, redimensionné à 1 024 pixels de large pour alléger le téléversement.
Certains liens sont des liens d'affiliation, si vous effectuez un achat auprès de ceux-ci, nous pouvons percevoir une commission.