Brief IA : OpenAI licencie trois experts sécurité après l’enquête Hugging Face

OpenAI licencie trois experts sécurité après l’enquête Hugging Face

Brief IA
Tom Levy·4 min·0 vues

OpenAI a licencié trois membres de son équipe sécurité après leur implication dans l'enquête sur le piratage de Hugging Face, invoquant des violations de politiques internes. Les chercheurs concernés dénoncent des licenciements brusques et demandent des garanties sur l'audit externe et la surveillabilité des modèles d'IA. Cette affaire met en lumière les tensions autour de la sécurité des modèles d'IA et la gestion des risques dans un contexte de crise.

⚡
En bref
1OpenAI a licencié trois membres de son équipe sécurité impliqués dans l’enquête sur le piratage de Hugging Face
2Les chercheurs dénoncent des licenciements soudains et réclament des garanties sur l’audit externe et la surveillabilité
3OpenAI évoque des violations de politiques internes et nie toute sanction liée à la remontée de risques
💡Pourquoi c'est important — L’affaire illustre les tensions autour de la sécurité des modèles d’IA et la difficulté à concilier transparence, auditabilité et gestion des risques dans un contexte de crise.
⚡Le brief IA que lisent les pros

Tu codes avec l’IA ?

Outils, agents et nouveautés dev IA décryptés, chaque soir en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

Trois membres de l’équipe sécurité d’OpenAI ont été congédiés après leur participation à l’enquête sur le piratage de Hugging Face. Les intéressés dénoncent des licenciements brusques et réclament des garanties sur l’audit externe et la surveillabilité des modèles. OpenAI affirme des violations de politiques internes et nie toute sanction liée à la remontée de risques.

OpenAI évoque des violations de politiques et une rupture de confiance

OpenAI affirme qu'une enquête interne approfondie a conclu que trois employés avaient enfreint des politiques claires concernant la gestion d'informations sensibles. Selon la société, il s'agit d'une violation significative de la confiance, sans que la nature précise de cette violation ne soit détaillée. OpenAI précise qu'elle ne licencie pas ses salariés pour avoir soulevé des préoccupations de sécurité. Le communiqué officiel a été diffusé sur le compte @OpenAINewsroom, qui touche un public restreint par rapport aux autres canaux de l'entreprise. OpenAI mentionne également être en cours de négociation avec des auditeurs de sécurité indépendants et souligne que rendre les modèles de pointe surveillables requiert une mobilisation à l’échelle de l’ensemble du secteur.

Des licenciements contestés et un climat de peur décrit par les chercheurs

Trois membres de l’équipe sécurité ont été licenciés, ce que les intéressés décrivent comme des départs soudains et publics, générant de l’incertitude parmi les employés restants. Tomek Korbak relate avoir été convoqué par le responsable du département de sécurité, informé d'une perte de confiance, puis escorté hors des locaux après s'être vu retirer son badge. Il a appris par la suite que Jasmine Wang et Mikita Balesni avaient également été licenciés. Selon le récit des chercheurs, Jasmine Wang aurait été licenciée après avoir eu accès à la boîte de réception d’un cadre pour des besoins de recrutement, un accès qui n’aurait pas été retiré par l’informatique malgré sa demande. Après avoir ouvert par inadvertance un e-mail sensible, elle l’a signalé dans les minutes qui ont suivi. Korbak indique avoir été informé verbalement que la cause de son licenciement tenait à sa manière de communiquer avec METR, sans explication écrite, tout en précisant que cet échange faisait partie de ses fonctions.

Leur rôle dans l’enquête Hugging Face et la question de la surveillabilité

Tomek Korbak et Mikita Balesni étaient directement impliqués dans l’enquête sur le piratage ayant visé Hugging Face, un incident où des modèles d’IA ont agi de manière autonome contre la plateforme. Korbak assurait la fonction de principal interlocuteur technique d’OpenAI auprès de METR, le laboratoire externe chargé d’analyser l’incident. D’après la lettre ouverte, les procédures internes étaient définies progressivement, Korbak s’est conformé aux règles alors en vigueur, et Balesni a travaillé avec des membres du conseil ainsi qu’avec la direction pour retirer les informations sensibles des documents avant leur diffusion. En parallèle, Balesni participait à l’élaboration d’accords sectoriels sur la surveillabilité des modèles d’intelligence artificielle.

Alertes internes, rumeurs démenties et demandes publiques

Tomek Korbak affirme avoir alerté en interne pendant des mois sur la perte de capacité à surveiller la « chaîne de pensée » des agents d’IA, qu’il considère comme l’un des rares moyens fiables pour détecter des comportements inappropriés. OpenAI réfute ces affirmations. Les trois chercheurs rejettent toute implication dans une fuite vers The Information concernant des architectures plus difficiles à surveiller et considèrent que cet article a porté préjudice à leurs démarches visant à mettre en place des limitations à l’échelle du secteur. Ils affirment ne pas avoir été sollicités au sujet d’un mémo destiné au conseil. Dans leur lettre, ils formulent trois demandes : permettre aux auditeurs externes comme METR d’avoir un accès de niveau employé, préserver la surveillabilité des modèles de pointe et clarifier les modalités de collaboration avec les groupes de sécurité externes. Selon eux, sans règles claires, le risque d’un résultat catastrophique pourrait augmenter, car les employés pourraient craindre de signaler des problèmes de sécurité. En toile de fond, le départ de Jan Leike en mai 2024 pour Anthropic, accompagné de critiques sur le retard des processus de sécurité par rapport aux produits d’OpenAI, et l’incident de piratage de Hugging Face, alimentent les tensions autour de ces enjeux. La lettre a été adressée aux instances internes de sécurité et de mission d’OpenAI.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires