Anthropic : 26 % de sa R&D IA pilotée par Claude sous supervision

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Anthropic publie des chiffres de supervision opérationnelle et de blocage automatisé, tout en appelant à plus de transparence entre laboratoires. En parallèle, l'entreprise rapporte que Claude dirige 26 % de sa R&D en IA, toujours sous supervision humaine. Ces mesures sont présentées comme un repère pour évaluer la proximité de l’auto‑amélioration récursive, alors que le débat sur la sécurité s’intensifie.
0,002 % de plus d’un milliard de décisions bloquées en août
Anthropic indique que ses systèmes de surveillance automatisés examinent les actions de son IA et qu’en août, 0,002 % de plus d’un milliard de décisions analysées ont été bloquées, soit environ une sur 47 000. Environ 50 cas jugés prioritaires sont remontés chaque semaine pour un examen humain. L’entreprise soutient que la publication de telles métriques donne au public, aux tiers et aux gouvernements une meilleure visibilité sur le rythme de développement de l’IA dans les laboratoires de pointe, avec à la clé une meilleure mesure, un rapportage public et la possibilité pour la société de décider comment utiliser ces informations. Elle suggère que d’autres laboratoires publient des chiffres comparables et en autorisent la vérification par des tiers.
Claude prend en charge 26 % de la R&D d’Anthropic avec supervision
Selon Anthropic, Claude assure désormais 26 % des activités de R&D en IA de l'entreprise. L'entreprise indique que le terme « diriger » signifie réaliser la majeure partie d’une tâche à partir d’une consigne générale, tout en restant sous la surveillance d’un humain. Il est précisé que Claude ne fonctionne pas de manière totalement autonome et qu’aucun segment mesuré du travail de R&D n’est effectué en autonomie complète par l’IA. La part de travail au niveau ou au‑dessus du seuil « l’IA collabore » dépasse 90 %. L’entreprise ajoute qu’en mars, cette proportion de tâches dirigées par Claude était de 1 %, voire inférieure à 1 % selon ses propres termes. Claude prend ainsi une place croissante dans les travaux qui nourrissent la prochaine génération d’IA de l’entreprise.
Ces indicateurs servent à jauger l’auto‑amélioration récursive
Anthropic présente le suivi de métriques comme un moyen d’évaluer à quel point l’IA se rapproche d’une amélioration autonome. L’entreprise définit l’auto‑amélioration récursive comme un modèle qui construit entièrement et de manière autonome son successeur. Elle avertit que des modèles accélérant leur propre développement pourraient rendre plus difficile la compréhension ou le contrôle humains. Elle estime donc important de partager des métriques pour apprécier la proximité de cette dynamique.
Démission interne et appel à coordonner un ralentissement
La semaine dernière, un chercheur d’Anthropic a quitté l’entreprise en reprochant aux principaux acteurs de l’IA de « jouer avec nos vies » en développant des modèles toujours plus puissants. Dans ce contexte, Dario Amodei invite les entreprises d’IA les plus avancées à organiser collectivement un ralentissement du développement, afin de permettre un meilleur déploiement des mesures de sécurité.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.