Brief IA

Mémoire des IA : baisse de précision et faux souvenirs par e-mail

🤖 Models & LLM·Tom Levy·

Mémoire des IA : baisse de précision et faux souvenirs par e-mail

Mémoire des IA : baisse de précision et faux souvenirs par e-mail
Key Takeaways
1Des chercheurs d’Adobe mesurent une forte chute de précision des assistants IA quand le contexte s’allonge
2Une faille permet d’inscrire un faux souvenir dans la mémoire d’un agent via un simple e-mail, sans alerte
3OpenAI et Anthropic proposent des outils de gestion de la mémoire, Google reste sur une suppression manuelle
4Les utilisateurs sont partagés sur l’intérêt de nettoyer la mémoire de leur assistant
💡Why it mattersLa gestion de la mémoire des assistants IA influence la qualité des réponses et pose des enjeux de sécurité et de contrôle pour les utilisateurs.
Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

Des tests montrent une baisse marquée de précision quand le contexte s’allonge et une faille permettant d’inscrire des souvenirs trompeurs via un simple e‑mail. Les fournisseurs multiplient les options pour gérer la mémoire, avec des approches différentes chez OpenAI, Anthropic et Google. Sur le terrain, les utilisateurs ne sont pas unanimes sur l’utilité de purger leur assistant.

Des chercheurs d’Adobe mesurent de fortes baisses de précision

Des chercheurs d’Adobe ont constaté que la performance des assistants IA diminue nettement lorsque le contexte s’allonge. Le taux de bonnes réponses de GPT-4o passe de 99 % à 70 %, celui de Claude 3.5 Sonnet de 88 % à 30 %, et Gemini 2.5 Flash de 94 % à 48 %. Anthropic a reconnu que le contexte doit être considéré comme une ressource limitée, dont l’efficacité décroît à mesure qu’il s’étend.

Un e-mail peut inscrire un faux souvenir, contesté par OpenClaw

Au mois de juillet, des experts en sécurité ont démontré qu’il est possible, en envoyant un simple e-mail à un agent conversationnel paramétré pour accéder à sa messagerie, d’introduire un faux souvenir dans sa mémoire persistante à l’insu de l’utilisateur. La démonstration ciblait principalement OpenClaw, qui a remis en cause la configuration retenue lors de ce test. OpenClaw précise que sa documentation recommande d’isoler les messages non fiables dans un lecteur séparé, sans accès à la mémoire.

L’empilement de souvenirs perturbe la mémoire des chatbots

Les assistants comme ChatGPT, Gemini et Claude retiennent des informations sur leurs utilisateurs pour personnaliser les réponses, mais l’accumulation de souvenirs anciens ou contradictoires peut brouiller la pertinence des échanges. Ce phénomène, rapproché par des chercheurs de la « pourriture de contexte », se manifeste par des incidents fréquents : instructions et faits s’entremêlent, se diluent ou sont ignorés, générant parfois des réponses incohérentes. Des souvenirs obsolètes peuvent rester actifs même après un changement de situation, comme un nouveau point de vue religieux ou l’invention d’un pays fictif qui réapparaît plus tard. Timothy B. Lee a expliqué cette logique. Andrew Grush a observé que, six mois après une simulation boursière fictive, ChatGPT continuait de citer cette expérience comme un fait réel dans d’autres conversations.

Les éditeurs outillent le nettoyage, Google reste manuel

OpenAI a introduit en octobre un tri automatique de la mémoire dans ChatGPT : lorsque la limite est atteinte, les informations les plus anciennes et les moins consultées sont supprimées en priorité. Les abonnés Plus et Pro peuvent marquer certains souvenirs comme importants pour éviter leur suppression. Anthropic a élargi l’accès à la mémoire de Claude aux abonnés Pro et Max, jusque-là réservé aux offres Team et Enterprise. Un espace mémoire propre est attribué à chaque projet, permettant à l’utilisateur d’afficher ou de modifier les données enregistrées, ou de lancer une session incognito qui ne sera pas sauvegardée. Pour Gemini, Google limite la gestion de l’historique d’activité à une suppression manuelle, sans proposer d’option de nettoyage automatique similaire à celle de ses concurrents. Concernant les pratiques, un sondage réalisé auprès des lecteurs d’Android Authority révèle que 54 % ne voient pas l’utilité de vider la mémoire de leur assistant, 24 % l’ont fait et ont noté une amélioration, 14 % n’ont pas observé de changement significatif et 8 % ont donné une réponse différente.

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.