Image IA : les 3 interfaces qui comptent (et un outil pour détailler tes prompts)
Chat, Google Flow, Weavy (devenu Figma Weave) : trois interfaces, trois niveaux de contrôle sur l'image IA. Plus ChatGPT Images 2.0 face à la famille Nano Banana, l'arrivée de Nano Banana 2 Lite, et archprompt.art pour muscler tes prompts.
Le mail de la semaine dernière parlait des agents qui travaillent avec tes fichiers. Cette semaine, retour sur l'image, mais avec un angle qu'on n'avait pas encore traité clairement : ce n'est pas seulement le modèle qui compte, c'est aussi l'interface où tu tapes ton prompt.
Trois interfaces, trois niveaux de contrôle
L'interface classique ChatGPT ou Gemini. Tu déposes ton image dans la conversation, ça génère l'image modifiée. Le plus accessible, mais peu de réglage fin et aucun workflow réutilisable d'une image à l'autre. Pas le plus pratique si on veut faire une série d'images.
Google Flow. Le studio créatif de Google, pensé pour l'image et la vidéo, accessible sur https://labs.google/fx/fr/tools/flow . Tu crées un dossier projet, tu glisses tes captures et tes images de référence, et chaque image devient un « ingrédient » réutilisable d'une génération à l'autre. Tu compares les itérations côte à côte et les images sont rangées par projet, c'est déjà plus clair. et cela permet de débloquer des options en plus : choix du modèle, le nombre d'images à créer et la possibilité d'exporter en meilleure qualité.
Weavy, en nodal. Ici tu as un plan de travail infini et tu branches des nœuds entre eux : image, références, modèle. C'est le contrôle maximal, et surtout un workflow rejouable, tu peux reprendre le même montage sur un nouveau projet. Weavy agrège l'ensemble des modèles d'images et de vidéos dans la même interface. C'est à tester ici avec 150 crédits par mois en version gratuite.
Pour un rendu d'insertion rapide, le chat suffit. Pour une série cohérente de 8 à 10 vues destinée à un client ou un promoteur, Weavy offre plus de contrôle et une meilleure interface.
ChatGPT Images 2.0 face à la famille Nano Banana
Côté OpenAI, le modèle en place s'appelle ChatGPT Images 2.0, sorti ce printemps. Deux points forts directement utiles pour nous : le texte et l'édition d'image sont meilleurs et rattrapent le modèle de Google.
Côté Google, Nano Banana existe désormais en trois versions. Nano Banana 2, le généraliste, celui qui tourne par défaut dans Gemini, le bon choix en édition d'image : garder une géométrie de départ et retoucher la matière autour. Nano Banana Pro permet plus de réflexion du modèle, à tester en variante si le modèle de base ne comprend pas la modif à faire. Et la nouveauté de fin juin, c'est Nano Banana 2 Lite : une version nettement plus rapide, environ quatre secondes par image. Pratique pour explorer plusieurs pistes, mais à l'usage elle est moins précise sur l'édition fine, idéal pour tester des variantes ou créer des images de référence. Le choix du modèle se fait dans Google Flow.
Je ne te donne pas de vainqueur absolu. Les deux (ChatGPT et Gemini) se valent et le bon réflexe reste de tester : prends le même prompt, lance-le sur les deux, compare toi-même sur un vrai visuel de projet. C'est cinq minutes, et c'est plus fiable que n'importe quel comparatif.
Les garde-fous à mettre dans tous les prompts
Une règle ne bouge jamais, quelle que soit l'interface : on ne change pas la géométrie, on garde le point de vue. L'IA habille la matière, elle ne reconçoit pas ton bâtiment à ta place. La formule à glisser dans tes prompts :
Garde strictement la géométrie, la perspective et la composition de cette image, ne modifie pas l'angle de caméra ni les volumes.
Vous pouvez retrouver toute une série d'exemples de prompts dans la section ressources du site : ici
Un outil pour avoir d'autres exemples de prompt
archprompt.art est un outil gratuit, pensé par et pour des architectes, mais seulement en anglais. Tu construis ton prompt dans l'outil (type d'image, lumière, cadrage etc...), tu le copies, tu le colles dans n'importe quel générateur. Utile pour avoir du vocabulaire et des mots clés pour les images d'archi, un exemple :
Generate a cinematic exterior view of the building, capturing a specific moment in time. Use dramatic lighting, weather effects (e.g., rain, fog, golden hour), and dynamic composition to evoke emotion and atmosphere. The architecture should be the protagonist in a larger visual narrative.
Et si tu testais autre chose cet été
Il y a un outil de plus dont je ne t'ai pas encore parlé ici, alors qu'il occupe mes soirées depuis des mois : cartes.archi L'idée : rentrer une adresse, choisir une ou plusieurs parcelles, et avoir l'ensemble des données existantes : Cadastre, PLU, Géorisque, DPE, Permis etc... De quoi commencer une faisabilité avec toutes les infos réunies au même endroit !
Je viens d'ouvrir les inscriptions de la bêta, gratuite, ouverte à tous et je corrige au fur et à mesure des retours, donc c'est le moment où ton avis compte. Si tu as cinq minutes cet été : Tester cartes.archi