OpenAI continue d'améliorer son modèle de génération d'images. Après une grosse mise à jour en avril dernier, l'entreprise vient de dévoiler Images 2.5. Cette version améliore encore le rendu, mais surtout, diminue le temps de chargement jusqu'à 50 %, ce qui sera pratique pour effectuer plusieurs modifications à la suite.
OpenAI promet tout d’abord des images plus fidèles, avec des détails plus fins, des textures plus riches et un éclairage plus naturel. Le modèle doit également mieux conserver l’apparence d’un sujet fourni en référence : un visage, un objet ou d’autres éléments caractéristiques devraient ainsi rester reconnaissables lorsque l’on change le décor, le style ou la composition. La firme affirme aussi avoir amélioré la compréhension des consignes complexes et le rendu des arrière-plans transparents.

Les retouches sont elles aussi censées gagner en précision. Images 2.5 cherche davantage à ne modifier que la partie demandée tout en laissant le reste de l’image intact. Cette amélioration vaut également pour les longues séries de retouches : OpenAI explique que le modèle conserve mieux les changements effectués précédemment et limite la dégradation progressive de l’image au fil des échanges. Une évolution bienvenue pour ceux qui préfèrent affiner progressivement un résultat plutôt que repartir de zéro à chaque essai.
ChatGPT reçoit au passage quelques nouveaux outils pour faciliter la création. Une fonction « Sketch » permet de griffonner directement une idée dans l’interface afin que le dessin serve de base à l’image finale. OpenAI ajoute également des modèles prédéfinis pour certains usages courants, comme la création d’une affiche ou d’un visuel de produit. Il est désormais possible de placer des commentaires directement sur une image pour indiquer plus précisément les zones à modifier, tandis que les créations partagées peuvent inclure leur prompt afin que d’autres utilisateurs puissent le réutiliser avec leurs propres éléments.
Images 2.5 est en cours de déploiement sur ordinateur, mobile et web auprès des utilisateurs de ChatGPT, ChatGPT Work et Codex, toutes formules confondues. Les développeurs ont de leur côté droit à deux déclinaisons dans l’API : GPT-Image-2.5 Flare, présenté comme le modèle généraliste et rapide, et GPT-Image-2.5 Sunburst, destiné aux travaux demandant davantage de précision au prix d’un temps de génération plus long. OpenAI indique par ailleurs que plus de trois milliards d’images sont désormais créées chaque semaine avec ChatGPT Images et ses modèles GPT-Image.













