Brief IA : Anthropic signale onze mois de filtres désactivés chez ses prestataires

Anthropic signale onze mois de filtres désactivés chez ses prestataires

Brief IA
Tom Levy·1 min·1 vues

Le rapport d’Anthropic révèle des filtres anti-armes biologiques désactivés La désactivation a duré onze mois sur des plateformes de prestataires humains L’entreprise prévoit des rapports de risques tous les 3 à 6 mois.

En bref
1Le rapport d’Anthropic révèle des filtres anti-armes biologiques désactivés
2La désactivation a duré onze mois sur des plateformes de prestataires humains
3L’entreprise prévoit des rapports de risques tous les 3 à 6 mois
💡Pourquoi c'est importantAnthropic publie un suivi régulier des risques de ses modèles et signale un incident précis de sécurité de onze mois.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Le dernier rapport de risques d’Anthropic signale un « trou » de onze mois : des filtres destinés à stopper les échanges liés aux armes biologiques sont restés inactifs sur des plateformes de sous-traitants. Le document intervient alors que l’entreprise prévoit de rythmer cet exercice d’évaluation des dangers de ses modèles.

Des filtres anti-armes biologiques inactifs pendant onze mois

Le rapport d’Anthropic indique que des filtres de sécurité, prévus pour bloquer les échanges liés aux armes biologiques, ont été désactivés. Cette désactivation a duré onze mois et a concerné des plateformes utilisées par ses prestataires humains. Le document évoque ainsi un trou de onze mois dans la sécurité de ses IA.

Un suivi des risques annoncé tous les 3 à 6 mois

Anthropic a publié son deuxième rapport de risques et prévoit de poursuivre l’exercice à un rythme de trois à six mois. L’objectif annoncé de ces rapports est d’évaluer le danger que représentent ses modèles d’IA. La parution est récente et porte sur les risques liés à ces modèles.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires