OpenAI GPT-6 Astra atteint 80% au test d’assemblage IKEA

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI franchit une étape sur un banc d’essai visuel : GPT-6 Astra atteint 80% d’exactitude pour repérer des erreurs d’assemblage sur des meubles IKEA, avec trois minutes d’analyse par photo. Le modèle devance les dernières versions d’Anthropic, tout en restant trop lent pour une aide en direct. Des chercheurs envisagent des usages ultérieurs pour la réparation automobile ou d’électroménager.
Pas d’assistance en direct et des usages techniques envisagés
La technologie n’est pas encore assez rapide pour guider l’assemblage en temps réel. Des chercheurs estiment toutefois qu’elle pourrait à terme s’appliquer à des tâches de réparation sur des voitures ou des appareils électroménagers. Astra est également performant dans des tâches robotiques visuelles. Les progrès réalisés, notamment avec Astra, sont jugés remarquables au vu des difficultés rencontrées récemment sur des tâches visuelles plus simples.
Scores : 80% pour Astra, devant les modèles d’Anthropic
Dix mois après le précédent état de référence, GPT-6 Astra atteint 80% d’exactitude avec un temps de trois minutes par photo. Les modèles d’Anthropic suivent : 70% pour Claude Fable 5.1 et 61% pour Claude Opus 5. En novembre 2025, le meilleur score était de 28% avec Claude Opus 4.5. La progression observée montre un passage de 28% à 80% en quelques mois.
Ce que mesure FAB et où en sont les modèles à poids ouvert
Le Furniture Assembly Benchmark d’Epoch AI consiste à photographier trois pièces IKEA pendant leur assemblage, en y introduisant des erreurs délibérées. Ces modèles analysent les images obtenues en les confrontant aux instructions, repèrent les fautes et décrivent l’origine du problème. Certains modèles chinois à poids ouvert, à l’exemple de Kimi K3, présentent un écart d’au moins sept mois sur les modèles les plus avancés.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.