Gemini 2.5 Flash Image dépasse GPT dans 6 benchmarks sur 7

Gemini 2.5 Flash Image vient de sortir mais écrase déjà les concurrents en génération d’images. Battant GPT Image dans 6 benchmarks sur 7. 10 jours de tests sous le nom de code nano banana — et voici le résultat le plus cool !

Imaginez l’ampleur de la dominance. 1ère place en performance globale, personnages, créativité, infographies, objets et environnements, recontextualisation de produits. Seulement en stylisation le modèle a perdu face à GPT Image et Qwen Image Edit.

Les capacités sont très cool. Prenez une image avec une pile de livres — le modèle les fait tourner, les place sur une commode, préserve les polices et corrige le positionnement relatif. Combiner 4 images en 1 ? Facile ! C’est un cocktail puissant de Photoshop, Figma et MidJourney dans une interface !

La fonctionnalité est très diverse. Remplacement d’objets sans artefacts, restauration de vieilles photos, colorisation professionnelle, suppression parfaite d’arrière-plan, changements d’éclairage. Tout par un prompt intuitif ! Décrivez simplement le résultat désiré avec des mots !

Caractéristique révolutionnaire — le modèle peut raisonner ! Il ne génère pas aveuglément mais est guidé par la logique du monde, puisant des connaissances de Gemini 2.5 Flash. Peut comprendre indépendamment le contexte et prendre la bonne décision de visualisation !

Tout ce plaisir coûte 39$ pour 1000 images.

Consistance des personnages au plus haut niveau ! Le modèle maintient l’identité et le caractère à travers de multiples générations. Le transfert de style fonctionne excellemment. On peut utiliser texte et images simultanément en entrée !

Google n’a pas seulement rattrapé les concurrents. Ils ont créé un outil universel qui combine génération, édition et compréhension logique du contexte.