Nano Banana Pro
Nano Banana Pro, outil intelligent spécialisé dans les images par IA
Étiquettes :Outils d’image IA couramment utilisésQu’est-ce que le Nano Banana Pro ?
Nano Banana Pro est un modèle professionnel de génération et d’édition d’images développé par Google DeepMind, dont le nom officiel est Gemini 3 Pro Image. Il utilise la capacité de raisonnement, les connaissances du monde et la compréhension multimodale de Gemini 3 Pro pour des conceptions visuelles complexes.
Ce modèle se concentre sur l’amélioration du texte dans les images, des infographies, des prototypes de produits, de multiples références visuelles et de la cohérence de la marque, et prend en charge une sortie jusqu’à 4K. Il reste le choix idéal pour les tâches complexes haut de gamme au sein de la famille Nano Banana, mais il n’est ni le seul ni le plus rapide des modèles d’images actuels.
Nom et code de modèle Nano Banana
| Nom courant | Modèle formel | Code du modèle API | Positionnement |
|---|---|---|---|
| Nano Banana 2 Lite | Gemini 3.1 Flash Lite Image | gemini-3.1-flash-lite-image | Vitesse maximale, coût minimal et haut débit |
| Nano Banana 2 | Gemini 3.1 Flash Image | gemini-3.1-flash-image | Vitesse, 4K, texte et outils de montage polyvalents |
| Nano Banana Pro | Gemini 3 Pro Image | gemini-3-pro-image | Conception complexe, connaissances mondiales, marque et contrôle précis |
| Nano Banana | Gemini 2.5 Flash Image | gemini-2.5-flash-image | Version ancienne de première génération, migration recommandée par les autorités |
Google a publié gemini-3-pro-image en version stable ; l’ancienne étiquette Preview ne doit plus être utilisée pour de nouveaux projets. Les développeurs doivent également se référer aux instructions de publication afin d’éviter d’utiliser des pseudonymes destinés aux utilisateurs finaux comme identifiants API fixes.
Fonction principale
- Générer des images haute fidélité en fonction des exigences de texte complexe.
- Editez et téléchargez l’image en conservant les personnes, les produits ou la mise en page spécifiés.
- Générer du texte multilingue plus clair et lisible dans l’image.
- Création de affiches, de maquettes de logos, d’emballages et de prototypes de produits.
- Transformer les données, les explications et les connaissances en diagrammes d’information et schémas.
- Obtenir des informations du monde réel en effectuant une recherche sur Google.
- Combiner plusieurs images de référence tout en maintenant la cohérence entre les personnages et les objets.
- Modifier localement l’objet, l’angle de la caméra, le plan de profondeur, la lumière et les couleurs.
- Traduire ou localiser le contenu visuel existant dans d’autres langues.
- Choisissez diverses proportions d’aspect ainsi que des sorties 1K, 2K et 4K.
- Dans une réponse, alterner l’affichage de texte et d’images.
- Utilisable via l’application Gemini, AI Studio, les API et Vertex AI.
Génération d’images à partir de texte
Le Nano Banana Pro convient aux prompts complexes qui exigent que le modèle comprenne d’abord la tâche avant de planifier l’image. Contrairement aux modèles qui se concentrent uniquement sur une génération rapide d’images, il accorde plus d’importance à la logique de composition, aux connaissances du monde et au contrôle fin.
Tutoriel de création d’une application Gemini
- Ouvrez l’application Gemini et sélectionnez la fonction de création d’image.
- Sélectionnez Thinking ou le mode d’image correspondant à la spécialité dans les options du modèle.
- Décrire le sujet, l’usage, le public cible, la composition, le texte et les proportions de sortie.
- Il est nécessaire de télécharger des images de référence légales pour conserver les personnages ou les produits.
- Vérifier le texte, les faits, les caractéristiques d’identité et les éléments de marque après génération.
- Poursuivez la conversation en modifiant uniquement une zone ou une variable de conception.
- Téléchargez les résultats et effectuez la révision finale dans un logiciel professionnel.
Structure des prompts professionnels
- Tâche : affiche, infographie, prototype de produit, storyboard ou image publicitaire.
- Public cible : âge, région, langue et environnement d’utilisation.
- Contenu : objets, données, titres et instructions qui doivent être présents.
- Composition : proportions de l’image, emplacement du sujet, espace vide et hiérarchie visuelle.
- Objectif : focale, angle, distance de l’objet, profondeur de champ et mouvement de la caméra.
- Lumière : temps, direction, intensité, température de couleur et ombres.
- Marque : emplacement du logo, codes de couleur, tendance de la police et éléments interdits.
- Résolution, langue, exigences de transparence et canaux de livraison.
Légendes dans l’image et localisation multilingue
Nano Banana Pro améliore la lisibilité du texte dans les images, et est idéal pour les affiches, les menus, l’emballage, les graphiques et les maquettes d’interfaces. Les responsables officiels recommandent toujours de définir d’abord le texte exact avant de demander au modèle d’y insérer du texte.
- Créer et vérifier séparément le titre, le texte principal et les chiffres.
- Contrôlez le nombre de mots pour éviter des pages remplies de petits caractères.
- Préciser la langue, l’accentuation, la ponctuation et les emplacements des sauts de ligne.
- Lors de la traduction d’une image, il est demandé que les autres éléments restent inchangés.
- Il faut vérifier l’autorisation pour les polices de marque ; des formes similaires générées par l’IA ne sont pas équivalentes à des polices authentiques.
- Le manuscrit final doit être corrigé mot par mot, il ne faut pas se contenter des miniatures.
Infographies et connaissances du monde réel
Le modèle peut transformer des recettes, du contenu pédagogique, des données et des instructions en diagrammes d’information, et il peut également s’enrichir d’informations du monde réel grâce à la recherche Google. La recherche en ligne améliore la mise à jour, mais ne garantit pas que tous les faits et les représentations visuelles soient entièrement exacts.
- Commencer par fournir les données clés et les définitions déjà vérifiées.
- Il est demandé d’indiquer l’unité, la date, la région et la méthode de statistique.
- Laissez le modèle générer d’abord un brouillon de texte, puis une infographie.
- Heure de génération des enregistrements météorologiques, sportifs et de données de marché.
- Les informations médicales, juridiques, financières et de recherche scientifique doivent être vérifiées manuellement.
- Il est difficile d’inclure la source complète dans l’image finale ; une liste des références doit être jointe séparément.
Plus de références graphiques et de cohérence
La documentation officielle indique que le Nano Banana Pro peut traiter jusqu’à 14 images d’entrée, dont 5 peuvent conserver une haute fidélité. La présentation initiale du produit souligne également qu’il est possible de préserver la similarité de jusqu’à 5 personnages.
| Taille de l’entrée | Description officielle des capacités | Conseils d'utilisation |
|---|---|---|
| De 1 à 5 cartes | Prend en charge une référence à haute fidélité | Matériaux adaptés pour les personnages, les produits et les marques |
| Jusqu’à 14 pièces | Plus d’éléments visuels peuvent être combinés | La cohérence peut diminuer dans des combinaisons complexes. |
| Jusqu’à 5 personnages | Insister sur le maintien de la similarité des personnages | Il reste à vérifier la forme du visage, l’âge, les vêtements et les mains. |
| Divers objets | Peut être utilisé pour la composition du portefeuille de produits et la création de scénarios | Définir les attributs à conserver pour chaque image de référence |
Consultez davantage les étapes opérationnelles illustrées.
- Ne sélectionnez que les images de référence ayant le droit de téléchargement et de création.
- Numérotez chaque image et indiquez son usage.
- Distinguer ce qui doit être conservé de ce qui peut varier librement.
- Testez d’abord la cohérence des personnages et des produits à l’aide d’un petit nombre d’images de référence.
- Ajoutez progressivement des éléments de fond, de vêtements, d’accessoires et de marques.
- Chaque tour ne modifie qu’un type de variable et enregistre la version stable.
- Agrandir pour examiner le visage, les mains, le texte, le logo et la structure du produit.
Édition locale et contrôle créatif
Le Nano Banana Pro permet de modifier localement le contenu par le biais de dialogues, et de contrôler l’angle de la caméra, la mise au point, la profondeur de champ, la lumière et le grading des couleurs. L’édition générative réinfère les pixels, ce qui ne garantit pas que les zones non spécifiées restent absolument inchangées.
- Changer la scène de jour en nuit tout en conservant le sujet.
- Changer la direction de la source lumineuse, le contraste clair-obscur et la teinte du film.
- Ajuster le point de mise au point et la profondeur de champ pour mettre en évidence un objet spécifique.
- Étendre ou réduire l’arrière-plan pour s’adapter aux nouvelles proportions de l’image.
- Remplacer un élément unique dans les vêtements, les accessoires et les décors.
- Transformer des esquisses, des plans ou des concepts en plans réalistes.
- Définir des exigences de verrouillage claires pour les zones qui n’ont pas besoin de modification.
Résolution de sortie et proportion
Le Nano Banana Pro prend en charge des images en 1K, 2K et jusqu’à 4K, et propose diverses résolutions courantes. La sortie en 4K est plus coûteuse et ne corrige pas automatiquement tous les problèmes de texte, de textures et de structure.
| Sortie | Utilisations adaptées | Prix de sortie standard API |
|---|---|---|
| 1K | Esquisses de pages web, photos sociales et vérification rapide | Environ 0,134 dollar par feuille |
| 2K | Conception en haute résolution, présentations et sortie de taille moyenne | Environ 0,134 dollar par feuille |
| 4K | Documents haute résolution, matériaux pré-impression et présentation détaillée | Environ 0,24 dollar par feuille |
Les prix mentionnés ci-dessus ne prennent en compte que les frais standard de l’API pour la génération d’images ; ils peuvent également inclure des coûts liés à l’entrée de texte, à l’entrée d’image, à la sortie de réflexion et à la recherche. Les forfaits Gemini destinés aux utilisateurs finaux ne sont pas facturés directement selon ce tableau d’API.
Affichage entrelacé de texte et d’images
Gemini 3 Pro Image peut générer en alternance des paragraphes de texte et des illustrations dans la même réponse, ce qui convient aux histoires, aux guides pédagogiques et aux instructions étape par étape. Les développeurs doivent parcourir les blocs de contenu de la réponse, et ne peuvent pas se contenter de lire un seul champ d’image.
- Des illustrations correspondantes peuvent être insérées entre les chapitres pour accompagner le récit.
- Les étapes pédagogiques peuvent afficher à la fois des explications textuelles et des schémas.
- Les réponses complexes nécessitent d’être sauvegardées et affichées dans l’ordre des blocs de contenu.
- L’interface utilisateur doit gérer les exceptions telles que l’absence d’images, les images redondantes et du texte vide.
- Chaque image générée est comptabilisée dans le coût de production.
Point d’accès dans l’application Gemini
Nano Banana Pro peut être utilisé sur la version web de Gemini ainsi que dans l’application mobile, généralement en créant une image et en sélectionnant un modèle de la catégorie Thinking. Les utilisateurs gratuits disposent d’un quota limité, tandis que les utilisateurs Google AI Plus, Pro et Ultra bénéficient de quotas plus élevés.
| Entrée | Manières d’utilisation | Explication |
|---|---|---|
| Application Gemini | Créer une image et sélectionner le modèle Thinking | La limite gratuite est limitée, la quota des abonnements payants est plus élevé. |
| Google AI Mode | Mode d’image professionnelle utilisé dans certains pays et langues | De nombreuses restrictions régionales, de compte et de forfaits. |
| NotebookLM | Créer des infographies et des diapositives | Peut être visualisé en fonction des profils d’utilisateurs et des résultats de recherche |
| Google Slides | Aidez-moi à visualiser et à embellir les diapositives | Destiné aux clients Workspace éligibles |
| Google Vids | Créer des éléments visuels pour le projet vidéo | Destiné aux clients Workspace éligibles |
| Flow | Générer et contrôler les images vidéo | Nano Banana Pro est destiné aux forfaits payants |
| Mixboard | Capacités de toile et de présentation | Produits expérimentaux de Google Labs |
Marques d’eau et identification de contenu par l’IA
Tous les résultats générés par les modèles d’images de Google contiennent une watermark numérique SynthID invisible. Les images générées gratuitement dans l’application Gemini ainsi que au niveau Google AI Pro peuvent également présenter une marque Gemini visible, tandis que les résultats générés par Ultra et AI Studio permettent de supprimer la watermark visible.
- Le SynthID invisible est utilisé pour identifier le contenu généré par Google AI.
- La suppression des marques visibles ne signifie pas que SynthID a été supprimé.
- Les plateformes et les régions peuvent exiger une divulgation supplémentaire concernant le contenu généré par l’IA.
- Les publicités, les nouvelles et la communication publique doivent indiquer clairement le contenu synthétique.
- Ne pas utiliser des images générées par l’IA pour simuler des personnes, des événements ou des preuves réels.
Forfait personnel Google AI
Google One propose actuellement trois forfaits d’IA personnelle : Google AI Plus, Pro et Ultra. Les prix, les taxes, la capacité offerte en bonus et les quotas de produits peuvent varier selon la région. Le texte du catalogue ne doit pas indiquer un prix fixe en yuans applicable dans le monde entier.
| forfait | Avantages liés au Nano Banana Pro | Adéquat pour les utilisateurs |
|---|---|---|
| Niveau gratuit | L’application Gemini a un quota limité ; une fois atteint, on passe à un autre modèle d’image. | Génération occasionnelle liée à l’expérience fonctionnelle |
| Google AI Plus | Quotas d’images et d’IA supérieurs au niveau gratuit | Création légère et utilisation quotidienne |
| Google AI Pro | Limites d’utilisation plus élevées pour le Nano Banana Pro et AI Studio | Étudiants, créateurs et professionnels |
| Google AI Ultra | Quota maximal, plus de capacité Flow et avantages de watermark professionnel | Création à haute fréquence et fonctionnalités d’expérimentation avancées |
Les prix réels des forfaits et la disponibilité des fonctionnalités dépendent de la page d’achat du pays ou de la région où se trouve le compte Google One. Les comptes Workspace, École et Entreprise sont également soumis aux autorisations de l’administrateur et aux restrictions des forfaits organisationnels.
Spécifications techniques de l’API Gemini
| Projet | Gemini 3 Pro Image |
|---|---|
| Code du modèle | gemini-3-pro-image |
| Type d’entrée | Texte et images |
| Type de sortie | Texte et images |
| Limite d’entrée de tokens | 65536 |
| Limite de tokens de sortie | 32768 |
| Génération d’images | Soutien |
| Raisonnement | Soutien |
| Recherche Google au sol | Soutien |
| Batch API | Soutien |
| Raisonnement flexible | Soutien |
| Raisonnement par priorité | Soutien |
| Function Calling | Non pris en charge |
| Structured Output | Non pris en charge |
| URL Context | Non pris en charge |
| Recherche de fichiers et mise en cache | Non pris en charge |
| Audio et API Live | Non pris en charge |
Prix standard de l’API Gemini
Voici les prix en dollars américains vérifiés en août 2026 sur la page des tarifs de l’API Google Gemini Developer. Le Nano Banana Pro ne dispose d’aucun niveau gratuit pour l’API ; les appels en production nécessitent un compte payant activé.
| Éléments de facturation | Prix de paiement standard | Explications de conversion |
|---|---|---|
| Saisie de texte ou d’image | 2 dollars par million de tokens | Une image d’entrée unique : 560 tokens, soit environ 0,0011 dollar |
| Texte et production de pensée | 12 dollars/million de tokens | Facturation selon le nombre réel de tokens générés |
| Sortie d’image | 120 dollars/million de tokens | 1K et 2K à environ 0,134 dollar, 4K à environ 0,24 dollar |
| Recherche Google au sol | 5000 requêtes de recherche gratuites par mois, puis 14 dollars/1000 requêtes | Le modèle Gemini 3.x partage une quantité gratuite, calculée en fonction des requêtes de recherche réelles. |
Prix Batch, Flex et Priority
| Modèle | Prix d’entrée | Texte et production de pensée | Sortie d’image | Adéquat pour la tâche |
|---|---|---|---|---|
| Batch | 1 dollar américain par million de tokens ; environ 0,0006 dollar américain par image. | 6 dollars par million de tokens | 1K ou 2K : environ 0,067 dollar ; 4K : environ 0,12 dollar | Génération batch hors temps réel |
| Flex | 1 dollar américain par million de tokens ; environ 0,0006 dollar américain par image. | 6 dollars par million de tokens | 1K ou 2K : environ 0,067 dollar ; 4K : environ 0,12 dollar | Tâches avec une capacité d’élasticité tolérable |
| Priority | Texte ou image : 3,60 $ par million de tokens | 21,60 dollars/million de tokens | 216 dollars/million de tokens d’image | Opérations de production nécessitant une capacité prioritaire et de faibles délais |
Les remises Batch et Flex sont significatives, mais les délais de réponse et les modalités de garantie de capacité diffèrent. Les entreprises peuvent également effectuer des achats via Vertex AI ; les frais liés à la région, à la quantité promise, au réseau et à d’autres services cloud doivent être calculés séparément.
Guide d’intégration API
- Créez un projet dans Google AI Studio et activez l’API Gemini payante.
- Créez une clé API et ne la stockez que dans l’environnement de gestion des clés du backend.
- Installer le SDK officiel Google Gen AI et fixer la version compatible.
- Envoyez la requête minimale en utilisant le code du modèle stable gemini-3-pro-image.
- Configurer le rapport, la taille et le mode de réponse de l’image de sortie.
- Conserver les blocs de texte et d’images dans la réponse.
- Enregistrer le coût réel des entrées, des sorties, de la mise à la terre et des tentatives de réessai en cas d’échec.
- Ajouter une limitation du débit, des délais d’attente, un recul exponentiel et une modération du contenu.
- Tests pré-production, quotas, retards et gouvernance des données.
Contrôle des coûts API
- Pour l’exploration créative, utilisez d’abord le Nano Banana 2 Lite ou 2.
- Ne confiez aux Pro que les pages complexes et à haute valeur pour leur génération.
- Utiliser 1K en phase de prévisualisation, puis générer en 4K une fois la version finale finalisée.
- Réduire les références répétées aux images et les prompts longs inutiles.
- La recherche d’ancrage n’est activée que lorsque des informations réelles sont vraiment nécessaires.
- Les tâches hors ligne utilisent Batch ou Flex pour réduire les coûts de génération d’images.
- Définir des budgets journaliers, des quotas et des alertes en cas d’anomalie pour les utilisateurs et les projets.
Comment choisir entre le Nano Banana Pro et la série 2
| Demande | Modèle recommandé | Raison |
|---|---|---|
| Esquisse rapide à haute vitesse de traitement | Nano Banana 2 Lite | Vitesse et coût en priorité |
| Génération universelle et édition rapide en plusieurs tours | Nano Banana 2 | Qualité, 4K, équilibre entre texte et vitesse |
| Infographies complexes et connaissance du monde | Nano Banana Pro | Le raisonnement et la recherche sont plus ancrés. |
| Marque et plusieurs images de référence en haute fidélité | Nano Banana Pro | Contrôle précis et cohérence en priorité |
| Sortie finale en grande quantité | Première sélection de la série 2, puis finalisation par Pro | Concentrer les modèles coûteux sur les produits finis clés |
| Projets existants de l’ancienne version | Passer à 2 Lite ou 2 | Les autorités ont classé la première génération comme une version ancienne. |
Quels scénarios d'utilisation conviennent
- Les designers créent des affiches haute fidélité, des emballages et des prototypes de produits.
- L’équipe de marque combine produits, personnages et normes visuelles.
- Les éducateurs transforment les connaissances et les données en diagrammes d’information.
- L’équipe marketing crée des publicités multilingues et des contenus localisés.
- L’équipe de production cinématographique crée des storyboards, des plans de scène et des maquettes d’éclairage.
- L’équipe e-commerce crée des scénarios de produits et des versions pour différents marchés.
- Les développeurs créent des applications pour la génération, l’édition et la conception d’images.
- Les utilisateurs Workspace créent du contenu visuel dans Slides et Vids.
- Les utilisateurs de NotebookLM transforment les documents sources en présentations et en schémas.
Tâches qui ne conviennent pas à une exécution directe
- Exiger que tous les faits et données dans l’image soient automatiquement et absolument exacts.
- Des fichiers de police précis, des calques vectoriels et une gestion des couleurs d’impression sont nécessaires.
- Création non autorisée de célébrités, de clients ou de personnages protégés.
- Considérer les images générées par l’IA comme des preuves dans le domaine de l’actualité, de la médecine ou de la justice.
- Projets qui doivent être entièrement hors ligne et dont les fichiers ne peuvent pas être envoyés dans le cloud.
- Chaîne de production dépendante de résultats aléatoires fixes et reproductibles au niveau des pixels.
- Utiliser des images de l’application gratuite Gemini pour une publication commerciale directe.
- Exiger que le modèle effectue des appels de fonction ou produise des données strictement structurées.
Avantages du produit
- Le raisonnement Gemini et les connaissances du monde conviennent aux tâches visuelles complexes.
- La capacité de localisation du texte et des langues multiples dans les images est particulièrement remarquable.
- Prend en charge la génération de visuels liés à des informations réelles via la recherche Google.
- Jusqu’à 14 images de référence peuvent être traitées.
- Offrir un contrôle plus strict sur la cohérence des personnages, des produits et des marques.
- Prend en charge l’édition locale, les plans, la profondeur de champ, les ajustements de lumière et de couleur.
- Offre une sortie 1K, 2K et jusqu’à 4K.
- Il est possible de retourner alternativement du texte et des images.
- Couvre Gemini, NotebookLM, Workspace, AI Studio et Vertex AI.
- Le modèle API stable prend en charge les modes Standard, Batch, Flex et Priority.
Restrictions d'utilisation et précautions
- Le Nano Banana Pro n’est pas le modèle le plus rapide ou le moins cher actuellement.
- L’API n’a pas de niveau gratuit ; les entrées, les sorties et la mise à la terre entraînent tous des frais.
- Le prix de la sortie d’une seule image en 4K est plus élevé que pour 1K et 2K.
- Le modèle n’est pas obligé de retourner strictement le nombre spécifié d’images conformément aux exigences.
- Jusqu’à 14 fichiers d’entrée ne signifient pas que chacun pourra être conservé avec la même qualité de fidélité.
- Le texte des images peut encore contenir des erreurs d’orthographe ou un agencement inapproprié.
- La recherche d’une connexion au sol peut générer plusieurs requêtes, chacune étant facturée séparément.
- Le modèle ne prend pas en charge l’entrée audio, les appels de fonction et la sortie structurée.
- Les quotas, les points d’accès et les watermarks pour les consommateurs varient en fonction du forfait et de la région.
- Les résultats générés peuvent contenir des erreurs factuelles, des biais ou des éléments inappropriés.
- L’utilisateur est responsable des droits relatifs aux marques de tiers, aux personnages, aux figures et aux images de référence.
Confidentialité et sécurité des données
La page de prix de l’API Gemini indique que les données des niveaux payants de Nano Banana Pro ne seront pas utilisées pour améliorer les produits Google. Gemini pour les consommateurs, Workspace et Vertex AI sont soumis à des conditions de données différentes ; il n’est donc pas possible d’appliquer directement la protection payante de l’API à tous les accès.
- Les activités sensibles privilégient les contrats d’entreprise et des environnements Vertex AI contrôlés.
- Ne mettez pas la clé API dans le navigateur, les applications mobiles ou le code public.
- Obtenir une autorisation claire avant de télécharger des éléments concernant des personnes, des produits et des clients.
- Supprimer les informations de localisation, d’appareil et d’identité personnelle de l’image.
- Enregistrer les images de référence, les mots-clés, la version du modèle et l’heure de génération.
- Définir des droits minimums, un budget et un contrôle d’accès aux journaux pour l’équipe.
- Vérifier les règles de résidence, de conservation et de suppression des données en fonction de la région d’activité.
GitHub et l’état open source
Les poids du modèle Nano Banana Pro, les données d’entraînement et les services hébergés par Google ne sont pas open source. Google a rendu publics sur GitHub le SDK Python officiel Google Gen AI et le Gemini Cookbook, tous deux sous licence Apache 2.0.
Le fait que les SDK et les exemples soient open source ne signifie pas que les modèles le soient également ; il n’est pas non plus permis d’exécuter Gemini 3 Pro Image localement en dehors des services Google. Les développeurs ont toujours besoin d’une clé API, d’un compte payant et d’appels cloud conformes aux conditions de Google.
Informations de base
| champ | Contenu |
|---|---|
| Nom du produit | Nano Banana Pro |
| Nom officiel du modèle | Gemini 3 Pro Image |
| Développeur | Google DeepMind |
| Code API stable | gemini-3-pro-image |
| Type d’outil | Génération d’images par IA, édition et modèles visuels multimodaux |
| Entrée | Texte et images |
| Sortie | Texte et images |
| Résolution maximale | 4K |
| Figure de référence | Jusqu’à 14 pièces, dont 5 en haute fidélité |
| Recherche d’atterrissage | Soutien à la recherche Google |
| Entrée principale | Gemini, AI Studio, Gemini API, Vertex AI et les produits Google |
| Fournit-on une API ? | Oui, les niveaux de paiement |
| Est-ce open source | Le modèle n’est pas open source ; le SDK officiel et le Cookbook utilisent Apache 2.0 |
| Identification du contenu par l’IA | Toutes les images générées contiennent SynthID |
Indice de recommandation
4,8 / 5. Le Nano Banana Pro offre des capacités complètes en matière de raisonnement visuel complexe, de texte multilingue, d’infographies, de multiples références visuelles et de contrôle de marque, ainsi qu’une API stable ; cependant, le coût, la vérification des faits, les permissions, les filigranes et la gestion des droits d’auteur restent des éléments essentiels pour une utilisation professionnelle.
Questions fréquentes
Quel est le nom officiel du Nano Banana Pro ?
Le nom officiel est Gemini 3 Pro Image, et le code du modèle API stable est gemini-3-pro-image. Nano Banana Pro est le surnom utilisé par Google pour ce produit.
Le Nano Banana Pro est-il encore le modèle le plus récent ?
Il reste le modèle haut de gamme de la famille, conçu pour les tâches professionnelles les plus complexes, mais Google a lancé les Nano Banana 2 et 2 Lite, plus rapides. Les différents modèles offrent des compromis variés en termes de qualité, de vitesse et de coût.
Est-ce que c’est gratuit ?
L’application Gemini offre aux utilisateurs gratuits un quota limité de Nano Banana Pro ; une fois ce quota atteint, d’autres modèles d’images sont utilisés. L’API Gemini ne dispose pas de niveau gratuit pour ce modèle.
Combien coûte la génération d’une image par API ?
Dans l’API standard, la sortie d’une image en 1K ou 2K coûte environ 0,134 dollar, et en 4K environ 0,24 dollar ; il faut également prendre en compte les coûts d’entrée, de texte et de sortie de réflexion, ainsi que les frais éventuels liés à la recherche.
Combien d’images de référence peut-on télécharger au maximum ?
La documentation officielle indique un maximum de 14 images d’entrée, dont 5 permettent une plus grande fidélité. Les combinaisons complexes nécessitent encore une vérification manuelle de la cohérence des personnes et des objets.
Est-ce que cela prend en charge la génération de texte chinois ?
Il prend en charge le chinois et d’autres langues, et améliore la capacité de traitement du texte dans les images ainsi que la localisation. Une révision mot par mot reste nécessaire pour la version finale.
Les images générées ont-elles une watermark ?
Tous les contenus générés comportent un SynthID invisible. Certaines offres destinées aux utilisateurs Gemini présentent également des marques visibles, tandis que des options comme Ultra et AI Studio permettent d’obtenir des images sans watermark visible.
Le Nano Banana Pro est-il open source ?
Le modèle n’est pas open source. Le SDK officiel de Google et le Cookbook sont open source et soumis à la licence Apache 2.0, mais il est encore nécessaire d’appeler les modèles hébergés par Google.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164