Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Le benchmark ARC-AGI-3, récemment introduit, met au défi les systèmes d'intelligence artificielle dans des environnements de jeu interactifs que les humains résolvent sans difficulté. Ce test vise à évaluer la capacité des IA à opérer dans des situations où elles ne peuvent pas s'appuyer sur leurs avantages traditionnels.
Malgré l'incitation financière considérable de 2 millions de dollars promise à toute IA capable d'égaler les performances d'humains non entraînés, les résultats actuels des modèles de pointe sont décevants. Aucun d'entre eux n'a réussi à franchir le seuil de 1 % de réussite.
Cette situation met en lumière les défis persistants auxquels les systèmes d'IA sont confrontés lorsqu'ils sont placés dans des contextes qui exigent une compréhension et une adaptation similaires à celles des humains.


