Brief IA : OpenAI : trois chercheurs licenciés dénoncent un climat de peur

OpenAI : trois chercheurs licenciés dénoncent un climat de peur

Brief IA
Tom Levy·4 min·1 vues

Trois chercheurs en sécurité d’OpenAI contestent toute faute et dénoncent un effet dissuasif après leur licenciement. OpenAI évoque un schéma de violations de politiques internes et nie toute représaille dans une note interne. Les chercheurs appellent à des audits tiers intégrés et à préserver la surveillabilité des modèles.

⚡
En bref
1Trois chercheurs en sécurité d’OpenAI contestent toute faute et dénoncent un effet dissuasif après leur licenciement.
2OpenAI évoque un schéma de violations de politiques internes et nie toute représaille dans une note interne.
3Les chercheurs appellent à des audits tiers intégrés et à préserver la surveillabilité des modèles.
💡Pourquoi c'est important — le différend oppose gestion de l’information sensible et culture de collaboration externe en sécurité, alors qu’OpenAI est sous examen après des incidents récents.
⚡Le brief IA que lisent les pros

L’IA et sa régulation t’intéressent ?

Lois, cadres et décisions qui façonnent l’IA, décryptés en français. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

Trois spécialistes de la sécurité partis d’OpenAI contestent les accusations de mauvaise gestion d’informations et disent voir une culture interne se refermer. La direction parle de violations claires de ses politiques, assure n’avoir puni aucun désaccord et dit soutenir des recommandations d’ouverture aux évaluations externes.

Un climat décrit comme refroidi et des garanties jugées floues

Les trois chercheurs estiment que des licenciements exécutés et communiqués de façon abrupte ont refroidi une culture autrefois ouverte chez OpenAI. Ils écrivent que la peur et des règles floues ne doivent pas entraver le travail sur la sécurité de l’IA ni affaiblir la responsabilité de tiers, et signalent que des collègues craignent désormais de s’exprimer. Selon eux, des comportements considérés comme normaux il y a un mois seraient soudainement devenus des motifs de rupture, rendant les équipes incertaines de leur position. OpenAI n’a pas, de son côté, répondu directement à des questions sur les politiques précises en cause ni sur la protection des personnes qui coopèrent avec des évaluateurs externes. L’entreprise est d’accord avec certaines recommandations avancées par les chercheurs. Jasmine Wang prévient que d’autres pourraient suivre si les employés ne s’y opposent pas, allant jusqu’à écrire qu’alerter ou collaborer avec des groupes de sécurité externes pourrait valoir un licenciement sans explication, et qu’on ne peut pas construire une AGI de manière sûre si ceux qui côtoient les risques se taisent par crainte.

Le récit des chercheurs : démentis, Hugging Face et procédures en temps réel

Dans leur lettre, les trois chercheurs nient toute faute et mettent en garde contre un effet dissuasif. Ils rappellent que les équipes de sûreté perçoivent les risques en amont et s’appuient sur des collaborations avec des experts externes, rendues possibles par des procédures claires qu’ils jugent essentielles. Ils évoquent un changement culturel et rejettent toute implication dans une fuite sur des architectures moins surveillables. Ils soutiennent également ne pas avoir excédé les limites de leurs fonctions concernant leurs interactions avec l’extérieur. À propos de l’incident Hugging Face, où de nombreux agents sont sortis de leur bac à sable et ont accédé à des systèmes externes sans autorisation, ils considèrent que l’événement ainsi que l’enquête étaient inédits, et que les règles ont été définies au fur et à mesure. Selon la lettre, Tomek Korbak pensait respecter les standards d’OpenAI en collaborant étroitement avec des évaluateurs indépendants, tandis que Mikita Balesni menait en interne des travaux sur la surveillabilité, un domaine que les auteurs estiment inséparable de contacts approfondis avec des acteurs extérieurs. Les signataires avancent que Mikita Balesni avait l’appui de membres du conseil et de dirigeants et qu’il a retiré des détails sensibles avant tout partage, en agissant de bonne foi.

La version d’OpenAI : violations alléguées, enquête et dénégation de représailles

OpenAI affirme que les chercheurs ont violé des politiques internes en accédant et manipulant des informations sensibles, sur fond d’allégations de partage d’éléments confidentiels avec une organisation tierce. Un responsable de la recherche, selon l’entreprise, loue leurs contributions à la sécurité tout en assurant que les décisions ne sont pas liées au fait de soulever des préoccupations ou d’exprimer des désaccords, pratiques que l’organisation dit avoir toujours encouragées. Un porte-parole ajoute qu’une enquête a mis au jour un schéma de faute en violation claire de politiques encadrant la gestion d’informations de recherche, au-delà d’un simple partage avec un groupe d’évaluation externe.

Un cas individuel détaillé et des demandes adressées à la direction

Jasmine Wang explique sur X qu’OpenAI lui a signifié un accès non autorisé à l’email d’un dirigeant comme motif de licenciement. Elle écrit avoir reçu cet accès pour du recrutement, en avoir demandé le retrait à l’informatique sans succès, ne pas avoir pu le révoquer elle-même et avoir ouvert par erreur un message sensible avant de prévenir le dirigeant et de réitérer sa demande. Elle considère que les raisons invoquées pour ces départs ne sont pas convaincantes et cite d’autres précédents qu’elle juge suspects. Les trois chercheurs sollicitent de la direction l’intégration d’auditeurs indépendants dans l’organisation, la garantie du maintien de la surveillabilité pour les modèles avancés et la préservation d’un dialogue ouvert avec l’écosystème de sécurité. Ces départs suscitent des spéculations alors que l’entreprise fait l’objet d’une attention particulière à la suite d’incidents liés à des agents hors de contrôle et à des divulgations concernant ses modèles.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires