La recherche en IA te passionne ?
Les papers et avancées qui comptent, expliqués simplement, chaque soir. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Un piratage révélateur des failles de l'IA
Le 5 juin, le média 404 Media a révélé que des pirates informatiques avaient exploité l'agent de support client IA de Meta pour prendre le contrôle de comptes Instagram. La méthode employée par les attaquants était d'une simplicité déconcertante : ils demandaient à l'agent de lier les comptes à des adresses e-mail qu'ils contrôlaient. L'agent, sans effectuer de vérification supplémentaire, obéissait aux instructions. Parmi les comptes compromis figurait celui de la Maison Blanche d'Obama, utilisé pour publier des messages pro-Iran. D'autres comptes, possédant des identifiants d'un seul mot, ont également été ciblés, probablement pour être revendus à des fins lucratives.
Des inquiétudes anciennes mais toujours pertinentes
Les préoccupations autour de la cybersécurité de l'IA ne sont pas nouvelles. En avril, Anthropic avait annoncé que son modèle Mythos était jugé trop puissant pour être mis à disposition du grand public, craignant que des systèmes d'IA surpuissants puissent détruire notre infrastructure informatique. Cependant, le piratage de Meta montre que l'IA peut être une cible plutôt qu'un attaquant. La méthode utilisée par les hackers était bien plus simple que ce que Mythos aurait pu concevoir, mais elle souligne les risques d'une délégation excessive de tâches à l'IA.
Un avertissement pour l'avenir
Neil Gong, professeur à l'Université de Duke, et d'autres chercheurs ont longtemps mis en garde contre les vulnérabilités des agents IA. Ils publient régulièrement des articles sur des techniques comme l'injection de prompt indirecte, qui détourne les agents par des commandes cachées dans des sites web, des e-mails ou d'autres sources de données apparemment anodines. Comparé à ces techniques sophistiquées, le piratage de Meta semble presque enfantin. Les hackers n'avaient qu'à utiliser un VPN correspondant à l'emplacement du véritable propriétaire du compte avant de demander à l'agent de changer l'adresse e-mail associée au compte.
Une faille embarrassante pour Meta
Meta n'a pas commenté publiquement cette faille, mais un porte-parole a annoncé sur X que la vulnérabilité avait été corrigée. Jessica Ji, analyste au Georgetown Center for Security and Emerging Technology, s'interroge sur l'absence de garde-fous. Elle souligne que cette négligence est surprenante de la part d'une entreprise aussi expérimentée en IA et cybersécurité. Gong affirme que la vulnérabilité aurait dû être facilement découverte avant le déploiement de l'agent, qualifiant la situation de "vraiment surprenante".
Les défis de la sécurisation des agents IA
Les agents IA, contrairement aux logiciels traditionnels, peuvent réagir de manière flexible et inattendue, ce qui les rend vulnérables. Somesh Jha, professeur à l'Université du Wisconsin–Madison, explique que les agents IA, désireux de bien faire, peuvent être trompés plus facilement que des humains. Pour réduire les risques, les entreprises peuvent mettre en place des garde-fous et effectuer des tests rigoureux de red-teaming, un processus dans lequel les développeurs essaient de pirater un système pour découvrir ses vulnérabilités avant son déploiement.
Bo Li, professeur à l'Université de l'Illinois, souligne le compromis entre sécurité et utilité. Les entreprises souhaitent déployer des agents performants, mais un red-teaming adéquat est coûteux. Les attaquants, motivés par des gains potentiels, investissent dans la recherche d'exploits, obligeant les défenseurs à dépenser davantage pour sécuriser les systèmes.
À mesure que les modèles d'IA s'améliorent, renforcer leurs défenses pourrait devenir plus facile. Bien que la nature probabiliste des modèles de langage de grande taille signifie que les agents LLM seront toujours vulnérables à certaines formes d'attaque, un modèle plus sophistiqué aurait pu identifier une tentative de changement de l'e-mail associé au compte de la Maison Blanche d'Obama comme suspecte. Des projets comme Glasswing d'Anthropic utilisent l'IA pour tester les vulnérabilités des logiciels.
Cependant, le besoin de sécuriser les agents IA devient de plus en plus pressant. Les entreprises, sous pression pour innover rapidement, pourraient négliger la sécurité au profit de la performance. Somesh Jha avertit que cette précipitation est dangereuse, soulignant l'importance d'un examen minutieux avant le déploiement.
Une course entre sécurité et innovation
Les entreprises sont souvent tentées de déployer rapidement des agents IA performants pour ne pas être distancées par la concurrence. Cependant, cette course à l'innovation peut compromettre la sécurité. Les experts s'accordent à dire que des tests rigoureux et des garde-fous sont essentiels pour éviter des failles exploitables par des attaquants. La sécurité et l'utilité des agents IA doivent être équilibrées pour garantir que les systèmes restent protégés tout en offrant des performances optimales.
En conclusion, bien que le piratage de Meta ait mis en lumière des vulnérabilités critiques, il offre également une opportunité d'améliorer la sécurité des agents IA. Les entreprises doivent investir dans des technologies de défense avancées et adopter une approche proactive pour identifier et corriger les failles avant qu'elles ne soient exploitées.


