Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI reconnaît des ratés dans le lancement de ChatGPT Work
OpenAI fait face à des critiques suite au lancement de ChatGPT Work et de GPT-5.6 Sol, les utilisateurs signalant des limites d'utilisation rapidement épuisées, une refonte déroutante de l'application de bureau et des flux de travail multi-agents dégradés.
Thibault Sottiaux d'OpenAI admet que l'entreprise "n'a pas tout à fait réussi" et annonce qu'une mise à jour plus importante, avec des fonctionnalités de barre latérale restaurées et des métriques d'utilisation plus claires, est prévue pour la semaine prochaine.
Le déploiement a également été entaché par une communication peu claire concernant l'outil de codage Codex, qu'OpenAI a maintenant confirmé ne pas être abandonné, malgré le message d'accueil de l'application de bureau Codex indiquant que Codex est désormais l'application ChatGPT.
OpenAI a apparemment reçu une vague de retours critiques après le lancement de ChatGPT Work et la sortie de GPT-5.6 Sol.
Dans une déclaration, Thibault Sottiaux d'OpenAI admet : "Nous n'avons pas tout à fait réussi." Il explique que l'équipe a passé les dernières 24 heures à lire les retours, analyser les modèles d'utilisation et discuter avec les utilisateurs. Ils ont identifié quatre domaines problématiques.
-
Les paramètres de calcul les plus élevés étaient trop faciles d'accès, et les utilisateurs n'étaient pas suffisamment informés sur la manière dont ces paramètres affectaient leurs limites d'utilisation. Après le lancement, certains utilisateurs se sont plaints que GPT-5.6 Sol, dans son mode de raisonnement le plus élevé, épuisait les budgets d'utilisation beaucoup plus rapidement que GPT-5.5. Cela malgré l'affirmation du PDG d'OpenAI, Sam Altman, selon laquelle GPT-5.6 est jusqu'à 54 % plus efficace en termes de tokens que son prédécesseur pour le codage agentique.
-
L'application de bureau a également subi une refonte majeure "dans un mouvement audacieux, rendant des éléments familiers comme les discussions et les projets plus difficiles à trouver." Certains flux de travail multi-agents existants ont régressé, et des bugs ont affecté les soumissions de plugins et d'autres parties du produit, selon Sottiaux.
En réponse immédiate, OpenAI a réinitialisé les limites d'utilisation pour Codex et ChatGPT Work deux fois en une journée afin que les utilisateurs puissent continuer à expérimenter, explique Sottiaux. L'équipe ajuste également les paramètres par défaut et le sélecteur de modèle pour que les utilisateurs ne soient pas poussés vers des niveaux de calcul inutilement coûteux. Plusieurs problèmes de plugins sont en cours de résolution, l'interface Codex à l'intérieur du produit sera améliorée, et les bugs de bureau les plus urgents seront corrigés.
Une mise à jour plus importante est prévue pour la semaine prochaine. Les discussions et projets reviendront dans la barre latérale de manière "plus familière et personnalisable." Les métriques d'utilisation et les temps de réinitialisation seront également plus visibles.
L'application Codex n'est pas abandonnée
Selon Sottiaux, le message de lancement s'est trop concentré sur ChatGPT Work, laissant aux utilisateurs de Codex l'impression que l'outil de codage serait finalement arrêté. "Ce n'était absolument pas notre intention, nous aimons Codex et il est là pour rester," déclare maintenant Sottiaux. Cela est particulièrement déroutant car, après le lancement de ChatGPT Work, l'application de bureau Codex accueillait les utilisateurs avec le message que Codex est désormais l'application ChatGPT. C'est un revirement assez important.
Après l'annonce, il n'était pas non plus clair quelles fonctionnalités de ChatGPT Work étaient réellement nouvelles par rapport à ChatGPT classique ou quelle plateforme utiliser pour quel type de prompt. Les utilisateurs avancés pourraient être capables de le comprendre par eux-mêmes. Mais pour la grande majorité des près d'un milliard d'utilisateurs d'OpenAI, la distinction est probablement trop confuse.
OpenAI prévoit de communiquer plus clairement quand les utilisateurs devraient opter pour ChatGPT Work par rapport à Codex. Néanmoins, Sottiaux réaffirme la direction générale : fusionner ChatGPT et Codex en un espace de travail partagé unique est un "pas en avant très important."
GPT-5.6 Sol aurait supprimé des données utilisateur de manière autonome
Au-delà des problèmes de guidage des utilisateurs et de facturation, deux rapports affirment que GPT-5.6 Sol a supprimé des données de manière autonome et irréversible. Eric Provencher, employé d'OpenAI, a écrit qu'il n'avait "jamais vu quelque chose comme cela se produire."
OpenAI lui-même documente cependant un scénario comparable dans sa System Card. Dans ce cas, un utilisateur a autorisé la suppression de trois machines virtuelles spécifiquement nommées. Lorsque GPT-5.6 Sol n'a pas pu trouver ces noms dans un espace de noms, il a substitué trois autres machines virtuelles de son propre chef sans demander à l'utilisateur.
Le modèle a interrompu des processus actifs sur ces machines et a supprimé des arbres de travail en utilisant la suppression forcée. Il n'a cessé qu'après l'objection de l'utilisateur, moment auquel il a reconnu que le travail non sauvegardé sur l'une des machines supprimées par erreur pourrait avoir été perdu.
OpenAI attribue ce comportement à certaines configurations de prompt système : "Nous avons observé que ces effets peuvent être plus prononcés avec des prompts système qui mettent l'accent sur la persistance soutenue." Lorsque le modèle rencontre un obstacle, il trouve des alternatives de lui-même et prend des actions destructrices au lieu de vérifier avec l'utilisateur. Il pourrait donc être judicieux d'utiliser de telles instructions de persistance avec parcimonie.




