Brief IA : Anthropic : 26 % de sa R&D IA pilotée par Claude sous supervision

Anthropic : 26 % de sa R&D IA pilotée par Claude sous supervision

Brief IA
Tom Levy·3 min·2 vues

Claude dirige 26 % de la R&D en IA d'Anthropic, toujours sous supervision humaine. En août, 0,002 % de plus d'un milliard de décisions ont été bloquées, soit environ une sur 47 000, avec environ 50 cas examinés chaque semaine par des humains. Anthropic appelle à plus de transparence sectorielle pour mieux évaluer l'avancée vers des IA capables d'auto-amélioration.

En bref
1Claude dirige 26 % de la R&D en IA d’Anthropic, sous supervision humaine
20,002 % de plus d’un milliard de décisions ont été bloquées en août, environ 50 cas étant examinés chaque semaine par des humains
3Anthropic publie ces métriques pour évaluer la proximité de l’auto-amélioration récursive et appelle à plus de transparence sectorielle
💡Pourquoi c'est importantCes chiffres servent de repère public sur l’avancée vers des IA capables d’auto-amélioration, dans un contexte de débat sur la sécurité et la gouvernance.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Anthropic publie des chiffres de supervision opérationnelle et de blocage automatisé, tout en appelant à plus de transparence entre laboratoires. En parallèle, l'entreprise rapporte que Claude dirige 26 % de sa R&D en IA, toujours sous supervision humaine. Ces mesures sont présentées comme un repère pour évaluer la proximité de l’auto‑amélioration récursive, alors que le débat sur la sécurité s’intensifie.

0,002 % de plus d’un milliard de décisions bloquées en août

Anthropic indique que ses systèmes de surveillance automatisés examinent les actions de son IA et qu’en août, 0,002 % de plus d’un milliard de décisions analysées ont été bloquées, soit environ une sur 47 000. Environ 50 cas jugés prioritaires sont remontés chaque semaine pour un examen humain. L’entreprise soutient que la publication de telles métriques donne au public, aux tiers et aux gouvernements une meilleure visibilité sur le rythme de développement de l’IA dans les laboratoires de pointe, avec à la clé une meilleure mesure, un rapportage public et la possibilité pour la société de décider comment utiliser ces informations. Elle suggère que d’autres laboratoires publient des chiffres comparables et en autorisent la vérification par des tiers.

Claude prend en charge 26 % de la R&D d’Anthropic avec supervision

Selon Anthropic, Claude assure désormais 26 % des activités de R&D en IA de l'entreprise. L'entreprise indique que le terme « diriger » signifie réaliser la majeure partie d’une tâche à partir d’une consigne générale, tout en restant sous la surveillance d’un humain. Il est précisé que Claude ne fonctionne pas de manière totalement autonome et qu’aucun segment mesuré du travail de R&D n’est effectué en autonomie complète par l’IA. La part de travail au niveau ou au‑dessus du seuil « l’IA collabore » dépasse 90 %. L’entreprise ajoute qu’en mars, cette proportion de tâches dirigées par Claude était de 1 %, voire inférieure à 1 % selon ses propres termes. Claude prend ainsi une place croissante dans les travaux qui nourrissent la prochaine génération d’IA de l’entreprise.

Ces indicateurs servent à jauger l’auto‑amélioration récursive

Anthropic présente le suivi de métriques comme un moyen d’évaluer à quel point l’IA se rapproche d’une amélioration autonome. L’entreprise définit l’auto‑amélioration récursive comme un modèle qui construit entièrement et de manière autonome son successeur. Elle avertit que des modèles accélérant leur propre développement pourraient rendre plus difficile la compréhension ou le contrôle humains. Elle estime donc important de partager des métriques pour apprécier la proximité de cette dynamique.

Démission interne et appel à coordonner un ralentissement

La semaine dernière, un chercheur d’Anthropic a quitté l’entreprise en reprochant aux principaux acteurs de l’IA de « jouer avec nos vies » en développant des modèles toujours plus puissants. Dans ce contexte, Dario Amodei invite les entreprises d’IA les plus avancées à organiser collectivement un ralentissement du développement, afin de permettre un meilleur déploiement des mesures de sécurité.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires