⚠️ AlerteSafety📧 Substack · il y a 1 mois
«les politiques de sécurité appliquées de manière inégale qu'Anthropic a mises en place sont sur le point de devenir une fable d'avertissement classique sur la façon dont des notions de sécurité et de contrôle étroites et auto-réalisatrices fonctionnent rarement.»

Citation originale

the unevenly applied safety policies that Anthropic have rolled out are on track to become a classic cautionary fable in how narrow and self-fulfilling notions of safety and control rarely work out.

NL

Nathan Lambert

Researcher · AI2 · US

Pourquoi ça compte

L'auteur souligne que les nouvelles mesures de sécurité d'Anthropic pour Claude Fable 5 pourraient paradoxalement nuire à la sécurité globale, illustrant les dangers d'une approche trop restrictive.

Source

www.interconnects.ai

Voir la source
📬 Newsletter gratuite

Ne rate rien de l'actu IA

Reçois chaque soir les 7 meilleures actus IA, décryptées en 5 min. Gratuit.

Le brief IA que lisent les pros

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Chaque soir à 19h

Gratuit · Pas de spam · Désabonnement en 1 clic

Autres prises de parole de Nathan Lambert

← Tous les hot takes IA