Depuis quelques semaines, Gemini a sorti un nouveau modèle de génération d’images Nano Banana. La génération et l’édition permise par le modèle sont impressionnantes.
En plus d’être plus qualitatif, le modèle respecte précisément les demandes textuelles, le respect de l’environnement (personnage, scène, objet, etc), et il est très puissant pour l’édition.
Il est capable de faire :
- Du text-to-image: générer des images quali depuis un prompt
- De l’image + text-to-image (édition) : partage d’image et utilisation d’un prompt pour ajouter, supprimer ou modifier des éléments, changer le style ou ajuster les couleurs.
- Multi-image vers image (composition et transfert de style) : plusieurs images en entrée pour créer une nouvelle scène ou transférer le style d’une image à une autre

- Affinage itératif : édition sous forme de conversation pour affiner une image au fil de plusieurs étapes, en effectuant de petits ajustements.

- Rendu de texte : génération d’images contenant du texte clair et bien positionné, idéal pour les logos, diagrammes et affiches.

Vous avez peut être déjà vu passer des usages funs comme avec cette application de photobooth :

ou encore avec Past Forward (partage d’image pour en générer plusieurs dans des styles selon les décennies)

Pour utiliser le modèle, c’est simple et accessible gratuitement directement sur Gemini :

Mais vous pouvez aussi l’utiliser sur l’espace développeur de Gemini : Google AI Studio et ce que je vous recommande. Vous aurez alors plus de contrôle dans la génération, c’est assez pratique.
C’est très bien tout ça mais concrètement, comment ça peut vous aider pour booster votre marketing ?
Ici, l’idée est de vous partager des exemples en série pour vous donner un maximum d’idées.
Générer des ads statiques
Depuis un simple prompt, vous pouvez générer des images statiques inspirantes avec logo / slogan. Le rendu est vraiment sympa et ça peut être utilisé comme un visuel statique pour de l’ads.

Mais vous pouvez aussi utiliser Google AI Studio pour générer une application dans des scènes différentes depuis une image.

Ici par exemple, on prend l’image du dernier Google Pixel pour le faire, celle ci que j’ai trouvée sur le web :

Avec un drag&drop sur mon application, en sélectionnant “publicité arrêt de bus”, voici le résultat :

Paranthèse pour le partenaire de cette édition : Brevo 💚
Comme on parle marketing, j’en profite pour vous parler de Brevo : outil complet de CRM et mailing.
Très compétitif sur la partie mailing (paiement à l’usage), ça évite d’être sur-facturé quand votre base de contacts grossis. Et on ne recevra plus des mails du type :

La gestion CRM se couple avec le mailing, possible de mettre en place des automatisations en drag&drop type zapier.
Vous pouvez essayer Brevo gratuitement dès aujourd’hui ou utilisez le code LOUISGRAFFEUIL pour bénéficier de 50% de réduction pendant 3 mois (abonnement annuel).
👉 Rendez-vous sur ici si ça vous intéresse

Générer des avatars / personnages / mascottes
Un des gros avantages du modèle, c’est la création de personnages réalistes et la cohérence dans l’édition / itération. C’est un gros plus et une opportunité de l’exploiter.
Cela peut vous amener à la création d’une mascotte pour votre site et la mise en scène sur les réseaux par exemple. Et vous pouvez même ensuite créer l’avatar depuis un dessin :

Le plus simple est de partager une image pour respecter vos contraintes. Si vous n’avez pas d’images, vous pouvez en générer une qui vous convient après plusieurs itérations.
Cela peut vous permettre de créer du contenu UGC en partageant une image de votre produit par exemple. J’y reviendrai dans une autre édition, c’est presque un sujet à part entière.
L’idée est de partir d’un produit et votre avatar pour une mise en scène. Avec l’utilisation du modèle VEO 3 (ou autre modèle de vidéo), cela donne quelque chose du type :
Le challenge aujourd’hui, c’est l’audio (en français) et la synchronisation des lèvres. Il y a d’autres complexités que je mentionne ici. Mais aujourd’hui, c’est quand même bcp de travail post-prod.

Simplifier l’édition d’images
Plus besoin d’utiliser Photoshop, le besoin est large et ça permet d’être plus autonome. ça peut être dans la suppression d’éléments, suppression d’arrières plan, ajout de filtres, etc. Des exemples en vrac :


La génération multi-références fonctionne très bien :

Générer des vidéos depuis vos images
Autre exemple ici avec l’utilisation de 3 images pour générer une vidéo. On part d’un modèle, une texture (image du milieu) et une scène.

On utilise Nano Banana pour générer des photos à la chaîne respectant les 3 images au dessus. On obtient alors ce résultat :

On les utilise pour générer une vidéo avec VEO 3 en utilisant la logique du start frame / last frame pour avoir des clips de 8 secondes, on assemble le tout :
Bonnes pratiques
Malgré les avantages, ces outils d'IA pour la création d'images sont encore sous-utilisés. Les équipes ne sont pas familières avec ces solutions et ne savent pas comment les exploiter.
Voici donc les bonnes pratiques pour un meilleur contrôle :
➡️ Être hyper-spécifique : plus vous donnez de détails dans votre prompt, plus vous avez de contrôle sur le résultat.
➡️ Corrigez la cohérence des personnages : si les traits d'un personnage changent après plusieurs modifications, relancez la conversation avec une description détaillée pour maintenir la cohérence.
➡️ Donnez du contexte et de l'intention : un prompt comme "Crée un logo pour une marque minimaliste et haut de gamme de soins de peau " donnera de meilleurs résultats que "Crée un logo"
➡️ Itérez et affinez : n'attendez pas un résultat parfait du premier coup. Utilisez le mode conversationnel du modèle pour faire de petits ajustements.
➡️ Utilisez des "prompts négatifs sémantiques" : au lieu de dire "pas de voitures", décrivez ce que vous voulez voir, par exemple "une rue déserte sans circulation".
➡️ Contrôlez la caméra : utilisez des termes photographiques (comme "plan large", "gros plan", "angle bas", "objectif portrait 85mm") pour contrôler la composition de l'image.



