Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI dévoile les capacités de ChatGPT Images 2.0
OpenAI a récemment lancé ChatGPT Images 2.0, un nouveau modèle de génération d'images qui repousse les limites de la création numérique. Ce modèle a été présenté jeudi dernier et se distingue par sa capacité à simuler des photos d'une grande fidélité au réel. Pour illustrer ses performances, OpenAI a partagé des exemples de captures d'écran fictives, démontrant comment ce modèle peut brouiller les frontières entre le réel et le virtuel.
Mardi, OpenAI a officiellement annoncé ChatGPT Images 2.0, en mettant en avant ses "capacités de réflexion". Parmi celles-ci, la possibilité de parcourir Internet et de "vérifier" ses propres résultats, ce qui constitue une avancée notable dans le domaine de l'intelligence artificielle. Les exemples fournis incluent des images qui semblent être des captures d'écran d'un utilisateur feuilletant un magazine, soulignant ainsi la capacité du modèle à créer des images qui imitent la réalité.
Une démonstration audacieuse sur les réseaux sociaux
Pour promouvoir le lancement de ChatGPT Images 2.0, OpenAI a partagé une image générée par IA sur X, qui imite une capture d'écran d'un onglet Google Chrome sur un Mac. Cette image montre un onglet ouvert sur le site de ChatGPT, discutant du livestream du nouveau modèle. Cette démonstration vise à prouver l'efficacité du modèle à créer des images qui peuvent être facilement confondues avec des photographies réelles.
Le PDG d'OpenAI, Sam Altman, a exprimé sa satisfaction lors du livestream en déclarant : "L'équipe a vraiment bien travaillé sur celui-ci." Cette déclaration souligne la confiance d'OpenAI dans les capacités de son nouveau modèle.
Une technologie multilingue et créative
ChatGPT Images 2.0 n'est pas limité à la langue anglaise. OpenAI a précisé que le modèle peut générer des images à partir de prompts rédigés dans plusieurs langues, y compris le japonais, le coréen, le chinois, l'hindi et le bengali. Cette fonctionnalité multilingue élargit considérablement le champ d'application du modèle, permettant à un public mondial d'exploiter ses capacités.
Parmi les exemples fournis par OpenAI, le modèle a créé des publicités réalistes, une photo d'un magazine physique, et plusieurs pages de manga. Ces exemples illustrent la diversité des applications possibles avec ChatGPT Images 2.0.
Enjeux de droits d'auteur et implications sociétales
Un porte-parole d'OpenAI a souligné que la société n'a pas l'intention de copier ou de reproduire des œuvres spécifiques. Les images sont générées à partir de modèles qu'elle a appris, ce qui permet des variations créatives sur des célébrités et des images réelles. Par exemple, le modèle a généré une version glam des années 1980 de l'investisseur légendaire Warren Buffett et un plan d'un dîner d'un éditeur de Business Insider.
OpenAI empêche la reproduction des styles d'artistes vivants individuels, mais permet de recréer des styles de studios plus larges. Mitch Stoltz, directeur des litiges en propriété intellectuelle pour l'Electronic Frontier Foundation, a déclaré que le dernier modèle ne soulève pas de problèmes de droits d'auteur, tant que les images générées ne sont pas substantiellement similaires à des œuvres existantes.
"Si le résultat est substantiellement similaire à quelque chose sur lequel le modèle a été entraîné ou qu'il a parcouru, alors il commence à y avoir une préoccupation en matière de droits d'auteur," a expliqué Stoltz. "Mais si c'est similaire au niveau d'une idée, ou juste quelque chose qui se produit dans le monde, ou même un style ou une ambiance — en général, ce n'est pas suffisant, et ce n'est pas une copie selon la loi sur le droit d'auteur."
OpenAI face aux défis juridiques
Malgré les précautions prises, OpenAI fait face à au moins une douzaine de poursuites en cours pour violation des droits d'auteur de la part d'écrivains et de médias, y compris The New York Times et George R.R. Martin. "Les problèmes de droits d'auteur sont les mêmes que si vous utilisiez simplement Photoshop, une chambre noire, ou un artiste humain pour faire ces types de répliques," a ajouté Stoltz. "Les enjeux pour la société, que vous les appeliez éthiques ou politiques, sont plus importants parce que c'est plus facile, plus rapide et plus accessible."
En dehors des implications sociétales, ChatGPT Images 2.0 offre un aperçu fascinant des possibilités futures de l'intelligence artificielle dans le domaine de la création visuelle.