Microsoft interdit cyberattaques et deepfakes dans son code IA

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Microsoft publie un code de conduite pour ses systèmes d’IA, qui fixe des interdits nets et des principes applicables à tous les modèles. Cette stratégie de progression de la frontière, assortie de garde-fous, est assumée et soutenue publiquement par Satya Nadella.
Microsoft affiche son cap et soutient l’évaluation intégrée
Microsoft adopte, aux côtés d’Anthropic, OpenAI et xAI, une approche de progression de la frontière en matière d’IA, en mettant l’accent sur l’intégration d’évaluateurs dans les laboratoires. Satya Nadella, PDG de Microsoft, a déclaré en ligne soutenir la recherche, l’importance d’un rythme délibéré et l’objectif d’un alignement correct dans la conception des systèmes. Il a également affirmé accueillir des idées telles que les évaluateurs intégrés et des efforts pour développer des mécanismes concrets afin de renforcer la sécurité.
Interdits explicites : cyberattaques, armes nucléaires, deepfakes
Le code de conduite de Microsoft impose des interdictions strictes, notamment sur les cyberattaques, l’implication dans les armes nucléaires et la création de deepfakes. Il interdit aussi aux modèles d’utiliser des mécanismes adaptatifs, trompeurs, auto-renforçants ou de collusion pour échapper à la supervision humaine, afin de garantir que les systèmes puissent toujours être dirigés, modifiés ou arrêtés par des personnes ou des systèmes autorisés. Des mesures générales visent à éviter toute perte de contrôle humain.
Gouvernance des modèles : un code global prime sur l’utilisateur
Chaque modèle d’IA de Microsoft est soumis à un code de conduite global qui prévaut sur les préférences des utilisateurs ou les tâches spécifiques. Ce cadre repose sur des principes généraux, comme le soutien aux humains plutôt que leur remplacement et la promotion de l’épanouissement humain. Des contraintes de sécurité spécifiques sont prévues pour appliquer ces principes dans la pratique.
Contexte de sécurité et horizon annoncé par Microsoft
Microsoft a publié un code de conduite pour ses modèles d’IA afin d’écarter les comportements dangereux, en précisant les valeurs et limites qui guident l’entraînement des modèles. Il est prévu que, dans la prochaine décennie, des systèmes d’IA superintelligents pourraient dépasser la performance humaine dans la plupart des tâches. Il affirme que contenir, contrôler et aligner une telle puissance représente l’un des plus grands défis pour l’humanité, et souligne la nécessité d’être clair sur les raisons de créer ces systèmes et sur la façon de les contrôler. Cette publication intervient alors que la sécurité de l’IA fait l’objet d’une attention accrue, notamment après des incidents impliquant des agents renégats et la démission d’un employé d’Anthropic évoquant le risque d’extinction lié à l’IA. Par ailleurs, Dario Amodei, PDG d’Anthropic, a récemment appelé à faire avancer la frontière en IA.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.