Brief IA : OpenAI révolutionne la création d'images avec ChatGPT Images 2.0

OpenAI révolutionne la création d'images avec ChatGPT Images 2.0

Brief IA
Tom Levy·4 min·3 vues

OpenAI a lancé ChatGPT Images 2.0, qui intègre des capacités de raisonnement et de recherche sur le web, permettant de générer jusqu'à huit images cohérentes à partir d'une seule invite. Ce modèle gère également mieux le texte, notamment dans les scripts non latins, ce qui élargit son accessibilité pour les créateurs de contenu.

En bref
1OpenAI a introduit ChatGPT Images 2.0, intégrant des capacités de raisonnement et de recherche web pour améliorer la création d'images.
2Le modèle peut générer jusqu'à huit images cohérentes par prompt, avec une meilleure gestion des textes non latins.
3Les utilisateurs de ChatGPT Plus, Pro et Business bénéficient de sorties d'images plus variées et précises grâce au mode de réflexion.
💡Pourquoi c'est importantCette avancée pourrait transformer la manière dont les images sont utilisées dans la publicité, l'éducation et le design, en augmentant la précision et la diversité des contenus visuels générés par l'IA.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

OpenAI enrichit ChatGPT Images 2.0 avec de nouvelles fonctionnalités

OpenAI a récemment dévoilé une mise à jour majeure de son générateur d'images, baptisé ChatGPT Images 2.0. Ce nouveau modèle intègre des capacités avancées de raisonnement et de recherche sur le web, permettant de créer des images plus cohérentes et variées. Désormais, les utilisateurs peuvent générer jusqu'à huit images à partir d'une seule requête, avec une gestion nettement améliorée des textes, notamment ceux utilisant des scripts non latins.

Un modèle d'image officiel et innovant

Le modèle d'image d'OpenAI, désormais officiel, repose sur le nouveau GPT Image 2. Ce modèle partage des similitudes avec le Nano Banana Pro de Google, notamment sa capacité à "réfléchir" avant de produire des images. Ce processus de réflexion, qui peut inclure des recherches sur le web, vise à améliorer la précision et la diversité des images générées. Cependant, ces fonctionnalités avancées sont réservées aux abonnés des plans ChatGPT Plus, Pro et Business.

Génération d'images multiples et cohérentes

Grâce au mode de réflexion, ChatGPT Images 2.0 est capable de produire jusqu'à huit images cohérentes à partir d'un seul prompt. OpenAI donne des exemples d'utilisation tels que la création de mangas d'une page, de séries graphiques pour les réseaux sociaux, ou encore de plans de design pour différentes pièces d'une maison. Ces capacités permettent de maintenir une cohérence dans les personnages, objets et styles à travers les différentes scènes générées.

Améliorations de la qualité d'image pour tous

Indépendamment de l'utilisation du mode de réflexion, tous les utilisateurs de ChatGPT bénéficient d'une meilleure qualité d'image. OpenAI affirme que le nouveau générateur capture plus fidèlement les caractéristiques des photos et améliore la qualité de l'art pixel, des mangas, des images de films, et d'autres types d'images. Le modèle est également optimisé pour gérer des éléments complexes tels que le petit texte, l'iconographie, et les compositions denses.

Support étendu des formats et résolutions

Le modèle prend en charge une variété de rapports d'aspect, allant de 3:1 (ultra-large) à 1:3 (ultra-haut), ce qui permet de créer des formats adaptés aux bannières, diapositives de présentation et écrans mobiles. La résolution des images peut atteindre jusqu'à 2K via l'API, offrant ainsi des possibilités accrues pour les développeurs et créateurs de contenu.

Tarification flexible basée sur les tokens

Les développeurs peuvent intégrer le modèle dans leurs produits via l'API sous le nom de gpt-image-2. OpenAI propose une tarification basée sur les tokens, avec des coûts de 8 $ par million de tokens d'entrée d'image et 30 $ par million de tokens de sortie d'image. Les coûts varient en fonction de la qualité et de la résolution des images, avec des prix allant de 0,006 $ pour une image de faible qualité à 0,211 $ pour une image de haute qualité en 1024 x 1024 pixels.

Des résolutions plus grandes à moindre coût

À des résolutions plus élevées, GPT Image 2 se révèle plus économique que ses prédécesseurs. Par exemple, une image de 1024 x 1536 pixels en haute qualité coûte 0,165 $, comparé à 0,20 $ pour GPT Image 1.5. Cependant, à la résolution standard de 1024 x 1024 en haute qualité, le nouveau modèle est légèrement plus cher à 0,211 $.

Cas d'utilisation variés et prometteurs

OpenAI met en avant plusieurs cas d'utilisation pour son nouveau modèle, notamment la publicité localisée, les infographies, le contenu éducatif, et les outils de design. Dans Codex, la génération d'images sera intégrée directement dans l'espace de travail, simplifiant ainsi l'accès pour les utilisateurs.

Performances impressionnantes dans les tests

Lors de tests internes, ChatGPT Image 2 a démontré une grande efficacité. Les modes instantané et réflexion ont tous deux réussi à gérer des prompts complexes avec une attention particulière aux détails. Par exemple, une image hyper-réaliste d'un singe tenant une banane rose sur un tigre, avec un cheval chevauchant un astronaute, a été rendue avec une clarté et une précision remarquables.

Accès limité et premières impressions

Le modèle d'image d'OpenAI, gpt-image-2, est actuellement testé par certains utilisateurs de ChatGPT. Les premières images générées, qui se rapprochent de véritables photographies, ont été partagées sur X et Reddit. Pour l'instant, l'accès semble restreint aux testeurs basés aux États-Unis.

Une avancée dans la génération d'images complexes

GPT-Image 2 excelle dans la création d'images complexes et de diagrammes avec texte, ce qui en fait un choix idéal pour des applications publicitaires et éducatives. OpenAI prévoit de dévoiler officiellement ce modèle lors d'un livestream, promettant de corriger les imperfections typiques des précédentes versions, telles que la peau trop lisse et l'éclairage irréaliste.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires