Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI publie 722 manuscrits produits par une IA non encore disponible et encadre leur diffusion avec des garde-fous de transparence et de vérification. L’entreprise dit s’appuyer sur un comité indépendant, des preuves vérifiables en Lean et des données sur le calcul mobilisé. Dans le même temps, un professeur de Rutgers juge l’un des résultats digne d’une médaille Fields s’il émanait d’un humain.
Des preuves vérifiables et un comité consultatif annoncés
OpenAI a publié 722 manuscrits mathématiques sur une plateforme permettant la gestion des citations et des révisions. Certaines démonstrations peuvent être vérifiées à l’aide du langage de programmation Lean. L’entreprise fournit également dans le référentiel des informations complémentaires sur la façon dont les résultats ont été obtenus, comprenant 10 résumés du raisonnement du modèle, des estimations de la puissance de calcul utilisée en termes d’usage de Pro sur ChatGPT, ainsi que des statistiques sur le nombre de problèmes traités. OpenAI précise s’appuyer sur un comité indépendant et consultatif pour définir les bonnes pratiques.
Une évaluation par problèmes ouverts et un temps moyen annoncé
OpenAI a généré 722 manuscrits, répartis en 372 groupes, à partir d’un modèle d’IA qui n’a pas encore été publié. Selon OpenAI, la résolution de chaque problème a nécessité en moyenne l’équivalent de trois heures sur « ChatGPT Pro thinking ». L’entreprise explique avoir adopté cette nouvelle méthode d’évaluation basée sur des problèmes mathématiques ouverts, car ses approches précédentes étaient devenues obsolètes.
Un modèle encore inédit et des réactions jusqu’à la médaille Fields
Le modèle d’IA utilisé pour produire ces résultats n’est pas encore disponible. La communauté scientifique examine les documents mis en ligne sur GitHub, et des réactions apparaissent sur X. Alex Kontorovich, professeur à l’université Rutgers, estime qu’un résultat relayé serait digne d’une médaille Fields s’il avait été obtenu par un humain.






