OpenAI Group PBC a annoncé aujourd'hui qu'il donnait à son outil de génération d'images une touche un peu plus artistique, en annonçant le lancement de ChatGPT Images 2.5, une mise à jour de ChatGPT Images 2.0 qui a fait ses débuts en avril.
Selon OpenAI, le nouvel outil est capable de générer des images avec « un éclairage plus naturel et des textures plus riches » qu'auparavant, et est plus efficace pour suivre les instructions de l'utilisateur « sur plusieurs tours ». Il est également beaucoup plus rapide qu'avant, capable de générer des images jusqu'à 50 % plus rapidement, et il existe un nouvel outil appelé Sketch, qui permet aux utilisateurs de dessiner des images en utilisant leur doigt sur un écran tactile pour les utiliser comme point de référence pour l'image qu'ils souhaitent générer.
Les mises à jour signifient également que ChatGPT Images est désormais mieux à même de préserver les détails des sujets dans les photos de référence, a déclaré OpenAI dans un article de blog. Par exemple, les traits distinctifs du visage et d’autres détails d’identification peuvent désormais être transmis de manière plus fiable à travers plusieurs générations d’images et modifications au sein d’une seule conversation.
Le nouveau modèle conservera également les détails que l'utilisateur ne lui a pas demandé de modifier lors d'une demande de modification. Il le fera même avec des scènes complexes comportant plusieurs sujets et objets ou des arrière-plans chargés. Avec ChatGPT Images 2.0, ces détails se dégradaient souvent lorsque les utilisateurs tentaient d'apporter des modifications ciblées, mais la version 2.5 parvient mieux à maintenir la stabilité globale de l'image, afin que les utilisateurs puissent effectuer des modifications précises.
Au cours de longues conversations, au cours desquelles les utilisateurs peuvent demander au modèle d'effectuer plusieurs modifications, cela garantira que les demandes précédentes seront respectées lorsque l'utilisateur demandera une autre modification. Cela signifie que les modifications antérieures resteront stables, chaque édition successive s'appuyant sur elles sans aucune perte de qualité, a indiqué la société. Il s'agit de prendre en charge les flux de travail créatifs itératifs.
Des croquis comme point de départ
Le plus gros ajout à ChatGPT Images 2.5 est peut-être Sketch, qui permet aux utilisateurs de dessiner directement dans ChatGPT et d'utiliser leur croquis comme référence visuelle pour l'image qu'ils souhaitent générer. L'utilisateur esquisse simplement une disposition approximative, une direction visuelle ou une composition, et le modèle s'appuiera sur ce point de départ pour générer une image plus soignée. Cette fonctionnalité profitera probablement à ceux qui utilisent un stylet, comme un Apple Pencil, car dessiner sur un écran tactile peut être un peu fastidieux dans le meilleur des cas.
Le modèle reçoit également de nouveaux modèles pour les formats d'image courants, tels que les dépliants et les photos de produits. Il prend également désormais en charge les commentaires en ligne sur les images pour permettre des modifications ciblées. Enfin, les utilisateurs peuvent désormais partager leurs invites avec les images qu'ils ont générées, afin que leurs amis et collègues puissent répéter leurs idées.
OpenAI a déclaré qu'il existe deux variantes de ChatGPT Images 2.5. Le premier est GPT-Image-2.5 Flare, qui est le modèle par défaut lorsque quelqu'un ouvre l'application pour la première fois. La société a déclaré qu'elle créerait des images de haute qualité deux à quatre fois plus rapidement que le modèle GPT-Image-2, avec une meilleure prise en charge des arrière-plans transparents, ce qui la rend idéale pour créer des actifs de marque, des présentations et des sites Web.
L'autre modèle est GPT-Image-2.5 Sunburst, qui sacrifie la vitesse au profit d'une plus grande précision, a expliqué la société. Cela prendra un peu plus de temps, mais les utilisateurs pourront générer des images avec une plus grande fidélité en termes de détails, ce qui pourrait être important pour certains professionnels de la création et artistes qui exigent une cohérence parfaite au pixel près. OpenAI a déclaré qu'il s'adresse principalement à des éléments tels que les photos de produits et les supports marketing, où chaque matériel doit être parfaitement conforme à la marque.
Du côté de la sécurité, OpenAI a déclaré que ChatGPT Images 2.5 dispose de plusieurs garde-fous sur les invites et les sorties pour empêcher la génération de contenu nuisible. Il utilise également des métadonnées C2PA et des techniques de filigrane invisible pour garantir que les images générées peuvent être identifiées comme telles, afin d'empêcher la réutilisation non autorisée et les deepfakes.
Le nouveau modèle est désormais disponible dans ChatGPT, ChatGPT Work et Codex sur ordinateur, mobile et Web, a déclaré OpenAI. Les développeurs peuvent également accéder à GPT-Image-2.5 Flare et GPT-Image-2.5 Sunburst via deux interfaces de programmation d'applications distinctes.