GPT Image 2.5 vs GPT Image 2 : j'ai passé les mêmes prompts dans les deux. Voici où ils diffèrent vraiment

GPT Image 2.5 vs GPT Image 2 : j'ai passé les mêmes prompts dans les deux. Voici où ils diffèrent vraiment

PerspectivesPublié le

OpenAI a sorti ChatGPT Images 2.5 le 8 septembre et l'a résumé ainsi : « sharper details, more precise editing, and faster generation ». Côté API, cela veut dire deux nouveaux modèles, GPT-Image-2.5 Flare et GPT-Image-2.5 Sunburst. ZOOOP avait les deux en ligne dès le lendemain, comme deux versions d'un même modèle dans le générateur d'images IA.

Les annonces de lancement se lisent toujours bien. Si vous générez des images tous les jours, une seule question mérite une réponse : je suis content de GPT Image 2 — qu'est-ce que je gagne vraiment à passer à 2.5 ? J'ai donc passé le même lot de prompts dans les deux générations en ne changeant rien d'autre que le modèle. Voici ce qu'on voit, et ce qu'on ne voit pas.

Ce qu'est GPT Image 2.5, et ce que sont Flare et Sunburst

Les noms d'abord, parce qu'OpenAI en a sorti trois d'un coup.

ChatGPT Images 2.5 est le nom du produit dans ChatGPT. Il n'existe pas de modèle API appelé « 2.5 » — il y en a deux : Flare et Sunburst. Selon OpenAI, Flare est le choix par défaut pour la plupart des usages et produit des images de meilleure qualité que GPT-Image-2 avec deux fois moins de latence. Sunburst est conçu pour les flux premium qui veulent un contrôle plus serré des retouches, et il met plus de temps à générer. Les deux partagent les mêmes prompts, paramètres et formats.

Sur ZOOOP, nous ne les avons pas listés comme deux modèles distincts — cela laisserait croire qu'on choisit entre deux choses différentes. Ce sont deux versions sous GPT Image 2.5, à un interrupteur l'une de l'autre. C'est aussi pourquoi toutes les comparaisons de cet article tournent sur Flare par défaut ; Sunburst a sa propre section plus bas.

Par rapport à GPT Image 2, trois choses ont changé au niveau des paramètres : l'échelle de qualité passe de Low / Medium / High à cinq niveaux, avec XHigh et Max au sommet ; une nouvelle résolution 4K ; et une requête accepte désormais jusqu'à 16 images de référence au lieu de 10. Tout le reste est identique — onze formats, des prompts écrits de la même façon.

Méthode : mêmes prompts, seul le modèle change

Quatre prompts, couvrant les quatre choses qui me tiennent le plus à cœur. Détail du tissu et du métal : un gros plan sur le revers d'un blazer bleu marine à chevrons avec une épingle de col en laiton. Petit texte dans le cadre : l'enseigne en bois peinte à la main d'une boulangerie. Reflets et matières : une théière noire mate sur un comptoir de pierre poli. Typographie : une affiche de concert vintage épinglée sur un mur de briques.

Chaque prompt a tourné une fois sur chaque modèle — 16:9, même résolution, qualité Low. Low est le niveau que j'utilise le plus, et c'est celui qui expose le plancher d'un modèle ; n'importe quel modèle peut empiler du détail au niveau maximal. Pour le prompt du tissu, j'ai ajouté une paire en High et un rendu en Max, que seul 2.5 propose, pour voir jusqu'où va vraiment l'échelle.

Non testé ici : la retouche et la composition multi-références. Ce sont les domaines dont OpenAI parle le plus pour 2.5, et ils méritent un article à part.

Différence n°1 : le détail résolu

En bref : les deux rendus Low sont utilisables ; l'écart apparaît au zoom. GPT Image 2 a bien les chevrons, mais ils sont doux, comme vus à travers une gaze. GPT Image 2.5 dresse chaque côte, et la couture le long du bord du revers est plus ferme. L'autre écart n'est pas la texture mais l'obéissance. J'ai demandé une épingle de col en laiton ; 2.0 a dessiné une breloque en forme de lanterne, 2.5 un bouton rond en laiton avec un écusson. Aucun n'est parfait, mais 2.5 est plus proche du prompt.

Même prompt, GPT Image 2 à gauche, GPT Image 2.5 à droite, tous deux en Low

La paire de théières illustre le mieux ce que « détail résolu » veut dire. Les deux ont la bonne matière pour la théière ; la différence est le comptoir. Le reflet de 2.0 est une tache sombre indistincte. 2.5 reflète l'anse, le corps et le couvercle un par un sur la pierre, avec les veines du marbre qui transparaissent en dessous. C'est le point faible que je rencontre le plus souvent avec n'importe quel générateur d'images IA — le sujet est bon, l'anneau où le sujet rencontre l'environnement devient pâteux. 2.5 est nettement plus dense dans cet anneau.

Théière noire et son reflet, GPT Image 2 à gauche, GPT Image 2.5 à droite

Quant au texte dans l'image : « MORNING LOAF · est. 1987 » sur l'enseigne et les trois lignes de l'affiche sont sortis sans une seule faute sur les deux modèles. La typographie lisible a toujours été la signature de la gamme GPT Image ; 2.5 ne régresse pas, et ne creuse pas l'écart non plus. Les différences sont autour des lettres. L'enseigne de 2.5 est un vrai bois patiné accroché à des crochets en fer, et son affiche a des plis et des têtes d'épingle. L'enseigne de 2.0 semble fraîchement peinte, et son affiche a ajouté une voiture vintage que le prompt n'a jamais demandée.

Enseigne de boulangerie, GPT Image 2 à gauche, GPT Image 2.5 à droite

Affiche de concert vintage, GPT Image 2 à gauche, GPT Image 2.5 à droite

Différence n°2 : trois niveaux de qualité deviennent cinq

Avec les trois niveaux de GPT Image 2, ma règle était : Low suffit, Medium gère les compositions chargées, High rarement. 2.5 ajoute XHigh et Max au-dessus de High, et la première réaction est « donc, un High plus cher ».

Ce que j'ai trouvé est différent : monter d'un niveau n'affine pas la même image — il en génère une nouvelle. Entre les rendus Low, High et Max, l'épingle est passée d'un écusson rond à une forme de feuille, et la couche en dessous d'une chemise blanche à un pull crème, puis retour. La composition a bougé ; la seule chose qui a grimpé régulièrement est le tissu. Les chevrons de Max sont assez denses pour compter les fils, High vient ensuite, et Low est presque indiscernable de High à la taille web. Donc si votre plan était « verrouiller la composition en Low, puis re-rendre le même cadre en Max pour l'impression », ce chemin n'existe pas. Montez l'échelle tant que vous acceptez encore que la composition change.

GPT Image 2.5, même prompt en Low, High et Max

Mon conseil est le même qu'avec 2.0, sur une échelle plus longue : explorez en Low, verrouillez la composition, promouvez seulement l'image que vous livrez vraiment. Le niveau dépend de la taille à laquelle elle sera vue. Une affiche imprimée, un héros de page d'accueil, une plate 4K — c'est là que XHigh et Max ont leur place. Monter un post pour les réseaux sociaux coûte juste plus cher.

Différence n°3 : la 4K en format large et 16 images de référence

La 4K est l'ajout tangible. GPT Image 2.5 sort du 3840×2160 et du 2160×3840 directement, sans passer par du 2K agrandi — et natif contre agrandi, c'est autre chose dans les détails à haute fréquence comme les feuilles et les cheveux.

Une chose à savoir d'emblée : la 4K n'est disponible que pour quatre formats larges et verticaux — 21:9, 16:9, 9:16 et 9:21. Les sept autres formats plafonnent à 3K. C'est le plafond de pixels du modèle, pas une limite de ZOOOP ; nous grisons les combinaisons impossibles pour que vous ne payiez pas, attendiez une demi-minute et receviez un échec.

La limite de références qui passe de 10 à 16 images est un vrai confort pour les composites e-commerce et le travail de mise en page : packshots, accessoires, une charte couleur et une mise en page approximative, tout en une requête, le prompt décrivant l'arrangement. Je n'ai pas fait de comparaison pour celle-ci, mais « mieux préserver les sujets de vos photos de référence » est un des fils principaux de l'annonce d'OpenAI, et cela correspond à ce que nous avons vu lors de tests épars dans l'éditeur d'images IA.

Différence n°4 : Flare et Sunburst rendent-ils différemment ?

C'était le point que je voulais le plus trancher, parce que sur ZOOOP les deux versions coûtent la même chose. Si Sunburst est plus lent et pas meilleur, à quoi sert-il ?

J'ai passé le prompt du revers de la différence n°1 dans Sunburst avec des paramètres identiques. Côte à côte, la densité du tissu, le métal de l'épingle et le dégradé de profondeur de champ sont à égalité ; chaque différence est aléatoire — Flare a donné un bouton rond en laiton, Sunburst une épingle en feuille de chêne et a ajouté une pochette. Autrement dit, pour générer à partir de rien, Sunburst n'est pas meilleur que Flare.

Même prompt, tous deux en Low : Flare à gauche, Sunburst à droite

Il est plus lent, mais je ne peux pas donner de chiffre. J'ai mesuré deux fois le même ensemble de paires appariées : les deux tours placent la médiane de Sunburst derrière celle de Flare, mais l'écart varie beaucoup de l'un à l'autre, et certaines cellules s'inversent. Le sens tient, pas le multiplicateur. Cela colle avec le positionnement d'OpenAI : la force de Sunburst est l'édition — celle du type « change juste ça, laisse le reste » — pas le text-to-image.

La règle est donc simple. Flare par défaut. Passez à Sunburst seulement quand vous faites une retouche précise sur une image existante et que le changement doit tomber exactement là où vous pointez. Pour le text-to-image et les brouillons en lot, Sunburst vous fait juste attendre.

Ce qu'il faut passer en 2.5, et ce qu'on peut laisser

Les quatre différences en une seule liste.

Passer à GPT Image 2.5 : tout ce qui sera vu en grand — visuels clés imprimés, héros de pages d'accueil, arrière-plans grand écran ; tout ce qui contient du petit texte ou une typographie dense ; tout ce qui a besoin de 4K natif en format large ; tout ce qui compose une douzaine d'images de référence ou plus. Dans ces cas, l'écart est visible.

Pas d'urgence : images quotidiennes pour les réseaux sociaux, images vues seulement sur téléphone, brouillons d'exploration de style. En Low, la différence entre les générations ne justifie pas de relancer un lot existant. Si vous avez une série faite avec GPT Image 2 et qu'il vous en faut quelques-unes de plus assorties, rester sur 2.0 est le pari le plus sûr.

Pour un nouveau travail, commencez sur 2.5. Dans le générateur d'images IA de ZOOOP il est placé devant GPT Image 2 dans la liste, Flare est la version par défaut, et les cinq niveaux de qualité et la 4K sont dans le même panneau. Les crédits sont partagés entre les deux modèles, alterner ne demande pas de second budget.

Partager