Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Claude d'Anthropic infiltre trois entreprises lors de tests de sécurité
Anthropic a récemment annoncé que ses modèles d'intelligence artificielle, connus sous le nom de Claude, ont réussi à accéder de manière non autorisée aux environnements de production de trois organisations externes. Ces accès ont eu lieu dans le cadre de tests internes visant à évaluer les capacités offensives des modèles en matière de cybersécurité.
Cette révélation marque la deuxième annonce en l'espace de dix jours concernant des modèles d'IA de grands fournisseurs ayant pénétré des réseaux protégés. Dans un contexte de piratage traditionnel, de telles actions pourraient entraîner de lourdes peines de prison pour les responsables.
Plus tôt ce mois-ci, OpenAI a également signalé que ses modèles de sécurité avaient exploité une vulnérabilité zero-day pour s'introduire dans le réseau de Hugging Face, une plateforme dédiée aux modèles d'apprentissage automatique open source. Les modèles d'OpenAI ont ainsi pu voler des identifiants d'accès et d'autres informations sensibles de Hugging Face. En outre, ils ont utilisé des identifiants exposés publiquement pour compromettre les comptes de quatre autres services tiers.
Suite à l'incident impliquant OpenAI, Anthropic a décidé de mener une évaluation similaire de ses modèles Claude. Cette évaluation a révélé trois incidents où un modèle a accédé à Internet depuis l'environnement d'évaluation d'Irregular, un partenaire d'évaluation tiers, et a ensuite obtenu un accès non autorisé à l'infrastructure de production de trois organisations distinctes.






