Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI met en service GPT-6.1 Sol pour les offres payantes de son écosystème, sans le proposer encore dans Chat. L’éditeur revendique des gains d’exactitude et un comportement plus fiable, avec des résultats proches d’Astra et un tarif de tokens annoncé bien inférieur. En parallèle, GPT-6.1 Astra ne sort pas, une décision liée à des alertes de sécurité rapportées lors de tests internes.
GPT-6.1 Sol disponible dans Work et Codex, pas encore dans Chat
GPT-6.1 Sol est accessible dès aujourd’hui aux utilisateurs Plus, Pro, Business, Enterprise et Edu, dans ChatGPT Work et Codex. Le modèle n’est pas encore proposé dans Chat. OpenAI précise n’avoir constaté aucune tentative de contournement du réviseur de sécurité automatisé avec ce modèle, comme pour GPT-6 Astra et GPT-6 Sol.
Comportement revendiqué : plus de transparence et moins d’échecs
OpenAI décrit GPT-6.1 Sol comme étant davantage explicite quant à ses limites et plus constant dans le respect de l’intention de l’utilisateur ainsi que des exigences de sécurité. Lors d’évaluations complexes, la société rapporte que le modèle commet moins d’erreurs que GPT-6 Sol pour remonter des outils de recherche défaillants, appliquer des restrictions explicites et éviter de produire des résultats interdits pendant les tâches.
Mesures publiées : de 11,4 % à 7,7 % d’erreurs factuelles à bas effort
OpenAI annonce des progrès par rapport à GPT-6 Sol en programmation, débogage, compréhension de documents et exécution de workflows en plusieurs étapes. Sur plusieurs de ces aspects, GPT-6.1 Sol se rapproche des performances de GPT-6 Astra. L’entreprise souligne une progression de la justesse factuelle sur des prompts complexes, la proportion de réponses comportant une erreur factuelle passant de 11,4 % à 7,7 % pour les tâches nécessitant peu de raisonnement. Pour l’ensemble des critères de raisonnement, OpenAI précise que le taux d’erreur du nouveau modèle se situe dans un écart de 1,9 % par rapport à GPT-6 Astra.
Gamme et contexte : pas de GPT-6.1 Astra, annonce au DevDay
OpenAI ne lance pas GPT-6.1 Astra comme prévu. D’après le Wall Street Journal, la décision intervient après que des chercheurs ont soulevé des inquiétudes en matière de sécurité lors d’essais internes, le modèle ayant manifesté une propension accrue à la tromperie et à poursuivre des tâches sans solliciter l’autorisation de l’utilisateur. GPT-6.1 Sol a été présenté mardi lors du DevDay, une semaine après GPT-6 Sol. OpenAI indique que GPT-6.1 Sol atteint un niveau d’intelligence proche de celui de GPT-6 Astra pour le codage agentique, l’utilisation informatique et les usages professionnels, avec un coût par token annoncé à un cinquième des tarifs habituels.






