⚡
Brief IA
›

Comptabilité : l’IA progresse mais reste sous supervision

🤖 Models & LLM·Tom Levy·

Comptabilité : l’IA progresse mais reste sous supervision

Comptabilité : l’IA progresse mais reste sous supervision
⚡
Key Takeaways
1Les modèles d’IA sont plus rapides, plus précis et moins coûteux que les comptables sur des tâches structurées
2Claude Opus 5.5, Fable 5.1 et GPT-6 Astra atteignent respectivement 61,8 %, 61,0 % et 57,9 % des critères
3Près de 60 % des tâches du benchmark n’ont pas été entièrement résolues et la clôture des livres nécessite une supervision
💡Why it matters — L’étude montre des progrès rapides de l’IA en comptabilité, mais souligne que des aspects essentiels du métier restent hors de portée des modèles actuels.
⚡Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

Des modèles d’IA dépassent des comptables sur des tâches structurées, selon Mercor, et les meilleurs atteignent entre 57,9 % et 61,8 % des critères. Près de 60 % des tâches restent pourtant sans solution complète et la clôture des livres requiert encore une supervision. Certaines dimensions clés du métier ont été écartées.

Pas de clôture autonome et un périmètre de test restreint

Mercor indique que les modèles d’IA ne sont pas capables de clôturer les livres sans supervision. Aucun modèle n’a entièrement résolu près de 60 % des tâches du benchmark. Les tâches testées correspondent à ce que l’IA maîtrise le mieux, comme le suivi précis des instructions et la recherche de détails. Des aspects essentiels du métier, tels que la communication avec les clients, la collaboration avec les collègues ou l’utilisation du contexte accumulé au fil des années, n’ont pas été évalués. Selon Mercor, ces omissions expliquent que les comptables ne peuvent pas être remplacés, même si des gains de productivité importants sont attendus dans le secteur.

Scores actuels et bond en dix-huit mois

Claude Opus 5.5 obtient le meilleur score avec 61,8 % des critères de notation respectés, suivi de Fable 5.1 à 61,0 % et de GPT-6 Astra à 57,9 %. Il y a un an et demi, les modèles d’IA les plus performants présentaient des résultats en dessous de la moyenne des comptables, fixée à environ 37 %. Désormais, ces mêmes modèles parviennent à traiter presque parfaitement les tâches simplifiées.

Ce que mesure APEX et comment la comparaison a été faite

Le référentiel APEX se compose de 160 exercices répartis entre 10 sociétés fictives, conçus par plus de 40 spécialistes disposant en moyenne de 11 années d’expérience. Dans le cadre de l’étude, douze experts-comptables certifiés, cumulant en moyenne cinq ans et demi d’expérience, ont effectué des versions simplifiées de ces tâches. Pour ces exercices standardisés, Mercor indique que les systèmes d’IA surpassent les professionnels en rapidité, en précision et en coût. La justesse des IA a été comparée à celle de comptables opérant sans aide, avec des résultats détaillés selon la date de lancement des modèles.

⚡

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.