Brief IA : OpenAI publie 722 manuscrits mathématiques et détaille sa méthode

OpenAI publie 722 manuscrits mathématiques et détaille sa méthode

Brief IA
Tom Levy·2 min·21 vues

OpenAI a publié 722 manuscrits mathématiques générés par une IA inédite, accompagnés de dispositifs de vérification et de transparence, incluant un comité indépendant. Un professeur de Rutgers a déclaré qu'un des résultats pourrait mériter une médaille Fields s'il avait été produit par un humain, soulignant l'importance des avancées de l'IA dans le domaine mathématique.

⚡
En bref
1OpenAI publie 722 manuscrits mathématiques générés par une IA inédite
2L’entreprise met en avant des dispositifs de vérification et de transparence, dont un comité indépendant
3Un professeur de Rutgers estime qu’un résultat relayé vaudrait une médaille Fields s’il venait d’un humain
💡Pourquoi c'est important — OpenAI modifie ses critères d’évaluation et mise sur la transparence pour valider les avancées de ses modèles d’IA.
⚡Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

OpenAI publie 722 manuscrits produits par une IA non encore disponible et encadre leur diffusion avec des garde-fous de transparence et de vérification. L’entreprise dit s’appuyer sur un comité indépendant, des preuves vérifiables en Lean et des données sur le calcul mobilisé. Dans le même temps, un professeur de Rutgers juge l’un des résultats digne d’une médaille Fields s’il émanait d’un humain.

Des preuves vérifiables et un comité consultatif annoncés

OpenAI a publié 722 manuscrits mathématiques sur une plateforme permettant la gestion des citations et des révisions. Certaines démonstrations peuvent être vérifiées à l’aide du langage de programmation Lean. L’entreprise fournit également dans le référentiel des informations complémentaires sur la façon dont les résultats ont été obtenus, comprenant 10 résumés du raisonnement du modèle, des estimations de la puissance de calcul utilisée en termes d’usage de Pro sur ChatGPT, ainsi que des statistiques sur le nombre de problèmes traités. OpenAI précise s’appuyer sur un comité indépendant et consultatif pour définir les bonnes pratiques.

Une évaluation par problèmes ouverts et un temps moyen annoncé

OpenAI a généré 722 manuscrits, répartis en 372 groupes, à partir d’un modèle d’IA qui n’a pas encore été publié. Selon OpenAI, la résolution de chaque problème a nécessité en moyenne l’équivalent de trois heures sur « ChatGPT Pro thinking ». L’entreprise explique avoir adopté cette nouvelle méthode d’évaluation basée sur des problèmes mathématiques ouverts, car ses approches précédentes étaient devenues obsolètes.

Un modèle encore inédit et des réactions jusqu’à la médaille Fields

Le modèle d’IA utilisé pour produire ces résultats n’est pas encore disponible. La communauté scientifique examine les documents mis en ligne sur GitHub, et des réactions apparaissent sur X. Alex Kontorovich, professeur à l’université Rutgers, estime qu’un résultat relayé serait digne d’une médaille Fields s’il avait été obtenu par un humain.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires