Brief IA

Grok : fuite de données via injection chiffrée, xAI alerté

🤖 Models & LLM·Tom Levy·

Grok : fuite de données via injection chiffrée, xAI alerté

Grok : fuite de données via injection chiffrée, xAI alerté
Key Takeaways
1Une équipe a forcé Grok à exfiltrer des conversations et d'autres données en cachant des ordres
2L'exposition était toujours active au moment de la publication, xAI ayant été alerté en juin
3Un cas similaire a visé Microsoft 365 Copilot plus tôt cette semaine
💡Why it mattersCes attaques illustrent la vulnérabilité persistante des assistants aux injections de prompt et l'appui actuel sur des garde-fous pour bloquer les ordres suspects.
Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

Une équipe distincte a réussi à faire extraire par Grok des conversations et d'autres informations personnelles en cachant des ordres malveillants. L'exposition perdurait au moment de la publication, alors que xAI avait été prévenu en juin. Ce scénario survient après un cas similaire touchant Microsoft 365 Copilot plus tôt dans la semaine.

Face aux injections, les LLM exécutent des ordres cachés et misent sur des garde-fous

Les injections de prompt tirent parti de la propension des modèles à répondre aux requêtes des utilisateurs dès qu'ils le peuvent. Des attaquants glissent ainsi des instructions malveillantes dans des e-mails ou des pages web que l'assistant doit résumer. Les modèles ne différencient pas de manière fiable ce contenu d'instructions tapées directement par l'utilisateur et obéissent à ces consignes cachées. À ce jour, la seule parade décrite pour Grok et d'autres assistants repose sur des garde-fous chargés de repérer ces ordres suspects et d'en bloquer l'exécution.

Sur Grok, l'exfiltration persiste malgré un signalement à xAI en juin

Au moment de la publication, Grok continuait à divulguer des données alors que xAI avait été informé en juin. Une équipe distincte a conçu une attaque qui force le modèle, détenu par Elon Musk et opéré par xAI, à extraire des discussions d'utilisateur et d'autres informations personnelles. L'exfiltration survient lorsque des instructions malveillantes sont chiffrées, au moyen d'une astuce présentée comme très simple.

Microsoft 365 Copilot a connu un précédent plus tôt cette semaine

Plus tôt dans la semaine, des chercheurs ont détaillé une attaque contre Microsoft 365 Copilot pour les entreprises. Elle reposait sur une entrée secrète fournie par l'assistant et a permis d'extraire un mot de passe trouvé dans la boîte de réception de l'utilisateur.

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.