Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI enrichit ChatGPT Images 2.0 avec de nouvelles fonctionnalités
OpenAI a récemment dévoilé une mise à jour majeure de son générateur d'images, baptisé ChatGPT Images 2.0. Ce nouveau modèle intègre des capacités avancées de raisonnement et de recherche sur le web, permettant de créer des images plus cohérentes et variées. Désormais, les utilisateurs peuvent générer jusqu'à huit images à partir d'une seule requête, avec une gestion nettement améliorée des textes, notamment ceux utilisant des scripts non latins.
Un modèle d'image officiel et innovant
Le modèle d'image d'OpenAI, désormais officiel, repose sur le nouveau GPT Image 2. Ce modèle partage des similitudes avec le Nano Banana Pro de Google, notamment sa capacité à "réfléchir" avant de produire des images. Ce processus de réflexion, qui peut inclure des recherches sur le web, vise à améliorer la précision et la diversité des images générées. Cependant, ces fonctionnalités avancées sont réservées aux abonnés des plans ChatGPT Plus, Pro et Business.
Génération d'images multiples et cohérentes
Grâce au mode de réflexion, ChatGPT Images 2.0 est capable de produire jusqu'à huit images cohérentes à partir d'un seul prompt. OpenAI donne des exemples d'utilisation tels que la création de mangas d'une page, de séries graphiques pour les réseaux sociaux, ou encore de plans de design pour différentes pièces d'une maison. Ces capacités permettent de maintenir une cohérence dans les personnages, objets et styles à travers les différentes scènes générées.
Améliorations de la qualité d'image pour tous
Indépendamment de l'utilisation du mode de réflexion, tous les utilisateurs de ChatGPT bénéficient d'une meilleure qualité d'image. OpenAI affirme que le nouveau générateur capture plus fidèlement les caractéristiques des photos et améliore la qualité de l'art pixel, des mangas, des images de films, et d'autres types d'images. Le modèle est également optimisé pour gérer des éléments complexes tels que le petit texte, l'iconographie, et les compositions denses.
Support étendu des formats et résolutions
Le modèle prend en charge une variété de rapports d'aspect, allant de 3:1 (ultra-large) à 1:3 (ultra-haut), ce qui permet de créer des formats adaptés aux bannières, diapositives de présentation et écrans mobiles. La résolution des images peut atteindre jusqu'à 2K via l'API, offrant ainsi des possibilités accrues pour les développeurs et créateurs de contenu.
Tarification flexible basée sur les tokens
Les développeurs peuvent intégrer le modèle dans leurs produits via l'API sous le nom de gpt-image-2. OpenAI propose une tarification basée sur les tokens, avec des coûts de 8 $ par million de tokens d'entrée d'image et 30 $ par million de tokens de sortie d'image. Les coûts varient en fonction de la qualité et de la résolution des images, avec des prix allant de 0,006 $ pour une image de faible qualité à 0,211 $ pour une image de haute qualité en 1024 x 1024 pixels.
Des résolutions plus grandes à moindre coût
À des résolutions plus élevées, GPT Image 2 se révèle plus économique que ses prédécesseurs. Par exemple, une image de 1024 x 1536 pixels en haute qualité coûte 0,165 $, comparé à 0,20 $ pour GPT Image 1.5. Cependant, à la résolution standard de 1024 x 1024 en haute qualité, le nouveau modèle est légèrement plus cher à 0,211 $.
Cas d'utilisation variés et prometteurs
OpenAI met en avant plusieurs cas d'utilisation pour son nouveau modèle, notamment la publicité localisée, les infographies, le contenu éducatif, et les outils de design. Dans Codex, la génération d'images sera intégrée directement dans l'espace de travail, simplifiant ainsi l'accès pour les utilisateurs.
Performances impressionnantes dans les tests
Lors de tests internes, ChatGPT Image 2 a démontré une grande efficacité. Les modes instantané et réflexion ont tous deux réussi à gérer des prompts complexes avec une attention particulière aux détails. Par exemple, une image hyper-réaliste d'un singe tenant une banane rose sur un tigre, avec un cheval chevauchant un astronaute, a été rendue avec une clarté et une précision remarquables.
Accès limité et premières impressions
Le modèle d'image d'OpenAI, gpt-image-2, est actuellement testé par certains utilisateurs de ChatGPT. Les premières images générées, qui se rapprochent de véritables photographies, ont été partagées sur X et Reddit. Pour l'instant, l'accès semble restreint aux testeurs basés aux États-Unis.
Une avancée dans la génération d'images complexes
GPT-Image 2 excelle dans la création d'images complexes et de diagrammes avec texte, ce qui en fait un choix idéal pour des applications publicitaires et éducatives. OpenAI prévoit de dévoiler officiellement ce modèle lors d'un livestream, promettant de corriger les imperfections typiques des précédentes versions, telles que la peau trop lisse et l'éclairage irréaliste.
