Brief IA

Anthropic signale onze mois de filtres désactivés chez ses prestataires

🤖 Models & LLM·Tom Levy·

Anthropic signale onze mois de filtres désactivés chez ses prestataires

Anthropic signale onze mois de filtres désactivés chez ses prestataires
Key Takeaways
1Le rapport d’Anthropic révèle des filtres anti-armes biologiques désactivés
2La désactivation a duré onze mois sur des plateformes de prestataires humains
3L’entreprise prévoit des rapports de risques tous les 3 à 6 mois
💡Why it mattersAnthropic publie un suivi régulier des risques de ses modèles et signale un incident précis de sécurité de onze mois.
Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

Le dernier rapport de risques d’Anthropic signale un « trou » de onze mois : des filtres destinés à stopper les échanges liés aux armes biologiques sont restés inactifs sur des plateformes de sous-traitants. Le document intervient alors que l’entreprise prévoit de rythmer cet exercice d’évaluation des dangers de ses modèles.

Des filtres anti-armes biologiques inactifs pendant onze mois

Le rapport d’Anthropic indique que des filtres de sécurité, prévus pour bloquer les échanges liés aux armes biologiques, ont été désactivés. Cette désactivation a duré onze mois et a concerné des plateformes utilisées par ses prestataires humains. Le document évoque ainsi un trou de onze mois dans la sécurité de ses IA.

Un suivi des risques annoncé tous les 3 à 6 mois

Anthropic a publié son deuxième rapport de risques et prévoit de poursuivre l’exercice à un rythme de trois à six mois. L’objectif annoncé de ces rapports est d’évaluer le danger que représentent ses modèles d’IA. La parution est récente et porte sur les risques liés à ces modèles.

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.