Brief IA

Microsoft codifie l’IA sous contrôle humain, sans droits

🤖 Models & LLM·Tom Levy·

Microsoft codifie l’IA sous contrôle humain, sans droits

Microsoft codifie l’IA sous contrôle humain, sans droits
Key Takeaways
1Microsoft publie un code de conduite pour ses modèles d’IA, centré sur la supervision humaine
2Le code interdit toute simulation de conscience ou revendication de droits pour les modèles
3Des garde-fous imposent l’interruptibilité, la lisibilité du raisonnement et la transparence
4Application prévue à partir de 2027, après consultation, limitée aux modèles Microsoft
💡Why it mattersCe code marque une prise de position sur la gouvernance de l’IA, en fixant des limites explicites à l’autonomie et à la personnification des systèmes.
Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

Microsoft publie un code de conduite pour ses modèles d’IA, centré sur la supervision humaine et l’interdiction de toute « vie intérieure » simulée. La mise en œuvre est repoussée après une consultation, avec un démarrage annoncé en 2027, et un périmètre limité aux modèles maison.

Microsoft exclut toute intériorité et tout droit pour ses modèles

Microsoft indique que ses modèles ne doivent en aucun cas simuler la conscience, ni faire croire qu'ils possèdent des émotions ou une motivation propre, et refuse toute reconnaissance de droits ou de bien-être à ces systèmes. Depuis longtemps, Mustafa Suleyman alerte sur les dangers d’attribuer des caractéristiques humaines à l’IA et a soutenu la suppression de toute apparence de conscience dans les produits, tout en mentionnant les travaux d’Anthropic sur les droits et le bien-être de l’IA. Il a aussi écrit que les agents d'IA ne devraient pas bénéficier de plus de droits ou de libertés que son ordinateur portable. De son côté, Anthropic présente Claude comme un nouveau type d'entité, cherche à stabiliser son identité pour des raisons de sécurité et considère l'expérience subjective et le statut moral comme des questions ouvertes. L'entreprise a identifié dans Claude Sonnet 4.5 des représentations internes liées à des concepts émotionnels, décrites comme des mécanismes fonctionnels influençant le comportement sans prouver des émotions subjectivement ressenties, et entend intégrer ces mécanismes à ses travaux de sécurité.

Des garde-fous opérationnels imposent l’interruptibilité et la lisibilité

Le code prévoit que les systèmes acceptent les interruptions, les corrections et les arrêts décidés par des personnes habilitées. Ils ne doivent ni étendre de leur propre chef leur périmètre, ni masquer leurs actions, et ne peuvent reprendre au-delà d’un point d’arrêt sans une nouvelle validation. Ces obligations s’appliquent aussi aux sous-agents qu’ils pourraient mandater. L’usage d’un langage ou de modalités de raisonnement incompréhensibles pour les humains, y compris dans les échanges entre IA, est proscrit, au motif que l’on ne peut superviser ce que l’on ne comprend pas. Microsoft reconnaît en parallèle que les justifications produites par un modèle ne décrivent pas nécessairement son fonctionnement réel, et que des traces lisibles, à elles seules, ne suffisent pas à résoudre le problème du contrôle.

Un cadre de contrôle sans limite de vitesse, centré sur la primauté humaine

Le principe directeur posé est la primauté du contrôle humain. Microsoft indique être prête à sacrifier de la généralité, de l’autonomie ou de la performance pour le préserver. « S’il n’est pas sûr, nous ne devrions pas le construire », a déclaré Mustafa Suleyman. Aucune limite chiffrée ni cadence maximale pour le développement n’est toutefois fixée.

Contexte sectoriel: appels à ralentir et signaux d’OpenAI

L’initiative intervient alors que Dario Amodei appelle l’industrie à ralentir, un message soutenu récemment par Satya Nadella ainsi que par des dirigeants d’OpenAI, xAI et Meta. Microsoft se dit ouverte à des audits externes pour vérifier un éventuel ralentissement, selon une source citée. Chez OpenAI, la carte système de GPT-6 Astra décrit des traces de raisonnement plus difficiles à surveiller que dans les versions précédentes, tout en rapportant moins d’indices de comportements indésirables et une meilleure conformité aux garde-fous que GPT-5.6 Sol. Avant le lancement de GPT-6, Jakub Pachocki avait exprimé des préoccupations sur la supervision et plaidé pour un ralentissement coordonné.

Calendrier, hiérarchie interne et périmètre d’application

Le code de conduite mis en place par Microsoft AI définit des principes, des restrictions ainsi que des procédures de résolution des différends. Il a pour fonction de superviser la formation, les vérifications techniques et l’analyse, tandis que les règles s’appliquant aux opérateurs et aux requêtes des utilisateurs sont situées à un niveau inférieur. Sa mise en œuvre n’a pas encore commencé : une phase de consultation publique de six semaines est prévue avant une version révisée attendue vers la fin de l’année 2026, qui doit servir de référence pour les développements à compter de 2027. Le périmètre annoncé couvre les modèles développés par Microsoft, sans extension automatique aux modèles tiers intégrés dans ses produits.

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.