Les meilleures solutions de mémoire pour vos agents IA Claude en 2026

CLAUDE.md, mem0, Letta, Zep, basic-memory, Obsidian avec MCP, AgentsRoom Project Memory : la carte honnête des solutions de mémoire pour agents IA, et comment choisir.

Ton agent a compris comment le module de facturation tient debout, s'est pris le piège de migration qui bouffe un week-end, et a tranché sur la raison pour laquelle il n'y a pas d'ORM à cet endroit.

Puis la session s'est terminée et tout est parti à la poubelle.

Demain il relira les mêmes douze fichiers, arrivera aux mêmes conclusions, et te facturera les mêmes tokens pour le plaisir. Tous ceux qui font tourner des agents de code se prennent ça dans la première semaine. Voici la carte honnête de ce que tu peux y faire, de ce que chaque option coûte vraiment, et de là où chacune casse.

D'abord, deux problèmes différents

La plupart des conseils sur la mémoire sont confus parce qu'ils mélangent deux choses qui demandent des outils différents.

Les instructions, c'est ce que tu sais déjà et que tu veux voir respecté. Tes conventions, tes commandes, tes règles d'architecture. C'est toi qui les écris. C'est stable.

Le savoir appris, c'est ce que l'agent découvre en faisant le boulot. Pourquoi une décision a été prise, quel module est un champ de mines, ce qui a pété la dernière fois. Personne ne l'écrit, et c'est exactement pour ça que ça se perd.

Un CLAUDE.md est excellent pour le premier et inutile pour le second. La plupart des outils ci-dessous existent à cause du second.

L'option gratuite que tu as déjà : CLAUDE.md et AGENTS.md

Commence par là, parce que beaucoup de gens sautent cette étape et achètent une base vectorielle à la place.

CLAUDE.md est un fichier Markdown que Claude Code lit au début de chaque session. Il se concatène en remontant l'arborescence, gère les imports @ jusqu'à quatre niveaux, et se combine avec .claude/rules/ pour des règles ciblées par glob. AGENTS.md est l'équivalent ouvert, désormais utilisé dans plus de 60 000 dépôts et par une vingtaine d'outils. À savoir : Claude Code ne lit pas AGENTS.md nativement. Le pont fourni par Anthropic, c'est un CLAUDE.md dont la première ligne est @AGENTS.md.

Claude Code embarque aussi sa propre mémoire automatique, distincte du CLAUDE.md : un MEMORY.md local à la machine et des fichiers par sujet, dont les 200 premières lignes ou 25 Ko sont chargés à chaque session.

Ce que ça gagne : gratuit, relisible en revue de code, éditable à la main, zéro infrastructure, portable.

Ce que ça casse : ça mange du contexte à chaque session, ça ne tient pas au-delà de quelques centaines de faits, et ça se périme en silence. Un MEMORY.md périmé est pire que rien, parce que l'agent démarre confiant et faux au lieu d'admettre qu'il ne sait pas. Le problème le plus souvent remonté sur cette approche n'est pas la qualité de récupération, c'est la saturation du contexte. Anthropic livre maintenant des propositions d'élagage via /doctor et sort une erreur franche quand le fichier dépasse sa limite de lecture, ce qui en dit long sur la fréquence du souci.

Si ce fichier n'est pas déjà propre chez toi, règle ça avant tout le reste. Notre guide CLAUDE.md couvre les patterns qui tiennent.

Les couches de mémoire managées : mem0, Letta, Zep

C'est la catégorie qui se vend le plus fort.

mem0 (Apache-2.0, environ 61 000 étoiles) est une couche de mémoire qui fait passer une extraction par LLM à l'écriture et range le résultat dans un index hybride sémantique plus mots-clés. Endpoint MCP hébergé, et un plugin Claude Code avec des hooks de cycle de vie. Gratuit jusqu'à 10 000 opérations par mois, puis 19 $, puis 249 $.

Letta (ex-MemGPT, Apache-2.0, environ 24 000 étoiles) prend un autre angle : les agents éditent leur propre mémoire par appels d'outils, dans une hiérarchie à la manière d'un OS avec des blocs de mémoire en contexte, un stockage de rappel et une archive vectorielle. C'est un client MCP, pas un serveur. Gratuit jusqu'à trois agents, 20 $ par mois au-delà.

Zep est le produit commercial bâti sur Graphiti, un moteur de graphe de connaissances temporel (Apache-2.0, environ 29 000 étoiles). Graphiti est la vraie curiosité de la liste : il est bi-temporel, il enregistre à la fois quand une chose s'est produite et quand elle a été ingérée, et il ferme des fenêtres de validité quand des faits se contredisent au lieu de supprimer. C'est la seule approche ici qui répond à « qu'est-ce qu'on croyait en mars ? ». Zep lui-même n'est pas open source, et sa Community Edition a été abandonnée en avril 2025.

Un truc à ignorer : les annonces de « state of the art » en mémoire d'agents. La dispute entre mem0 et Zep sur les scores LoCoMo n'est pas tranchée et tous les benchmarks concernés sont produits par les vendeurs eux-mêmes. Le 84 % de Zep comptait une catégorie adversariale au numérateur mais pas au dénominateur, le rerun de mem0 est tombé à 58,44 %, Zep a répondu 75,14 %. Choisis sur l'architecture et le coût, pas sur un chiffre dans un post de lancement.

Ce que ça gagne : l'échelle, la récupération sur des historiques énormes, zéro ops en hébergé.

Ce que ça casse : des échecs de récupération silencieux, un appel LLM à chaque écriture, une suppression imprécise (vrai problème RGPD), et ton code qui quitte ta machine. Il y a aussi une dérive documentée de l'open source vers le commercial : Zep CE abandonnée, le composant OpenMemory de mem0 en fin de vie, Supermemory qui verrouille l'auto-hébergement supporté. Lis la licence avant de construire dessus.

Les serveurs MCP nativement Markdown : basic-memory et compagnie

basic-memory (AGPL-3.0) est un serveur MCP qui construit un graphe sémantique à partir de Markdown brut. Les fichiers restent la source de vérité, SQLite n'est qu'un index, et les entités et relations viennent des WikiLinks. Gratuit en local, 15 $ par mois en cloud.

C'est la forme que beaucoup de gens veulent vraiment : des fichiers que tu peux lire et differ, avec une vraie couche de récupération par-dessus.

La piste Obsidian

Tu vas croiser beaucoup de contenus « construis ton second cerveau IA avec Obsidian et Claude Code ». C'est un workflow réel, alors voici ce qui est vrai.

Obsidian est une application Markdown locale et gratuite, avec une vue graphe et près de 6 000 plugins communautaires. Elle a livré une CLI officielle début 2026, dont la documentation parle explicitement de donner aux outils agentiques la capacité d'interagir avec ton coffre. Son CEO publie un jeu d'Agent Skills pour les formats Obsidian.

Ce qu'elle n'a pas : la moindre fonctionnalité IA officielle, et le moindre serveur MCP officiel. L'accès agent passe par des composants communautaires que tu choisis. Le plugin Local REST API embarque désormais son propre serveur MCP, et il existe plusieurs serveurs MCP Obsidian tiers. GitHub renvoie plus de 1 800 dépôts pour « obsidian mcp », ce qui prouve à la fois que ça marche et que personne n'est d'accord sur la façon de faire.

Deux points à connaître avant de bâtir une équipe là-dessus. Le partage d'un coffre passe par Obsidian Sync, entre 4 et 8 $ par utilisateur et par mois, plafonné à 20 collaborateurs, chaque collaborateur devant avoir son propre siège payant. Et la documentation d'Obsidian dit elle-même que l'édition collaborative en direct n'est pas encore supportée ; le multijoueur est listé comme prévu sur la feuille de route. Des plugins communautaires comme Relay l'ajoutent.

Autre chose à corriger au passage : la licence commerciale d'Obsidian est devenue optionnelle en février 2025. L'application est gratuite en usage professionnel. Beaucoup de comparatifs racontent encore le contraire.

On a détaillé tout ça dans AgentsRoom vs Obsidian, y compris les lignes où Obsidian est franchement le meilleur outil.

La mémoire intégrée à l'IDE : AgentsRoom Project Memory

Toutes les options ci-dessus te demandent d'assembler quelque chose : un service où s'inscrire, un serveur à faire tourner, un plugin à maintenir, un fichier à tenir à jour à la main.

Project Memory dans AgentsRoom prend le chemin inverse. La mémoire vit dans l'IDE où tes agents tournent déjà, et ce sont les agents qui l'écrivent.

Trois outils MCP sont livrés avec. memory_list et memory_get pour lire, que les agents ont pour consigne d'appeler avant de partir crawler une codebase. memory_save pour écrire, sans étape de confirmation, si bien qu'enregistrer devient un geste de travail normal plutôt qu'une chose qu'il faut penser à demander. Les notes atterrissent dans cinq dossiers qui se créent au premier usage : architecture, decisions, conventions, pitfalls, features. Enregistrer sous un nom existant met la note à jour sur place, donc la mémoire s'approfondit au lieu de s'étaler.

Le point qui compte le plus pour une équipe : la mémoire est indexée sur l'identifiant de projet commité dans ton dépôt, pas sur ton compte utilisateur. Ton coéquipier clone, ouvre le projet, et ses agents héritent de tout ce que les tiens ont appris. Pas d'invitation, pas d'export, pas d'abonnement par siège. C'est inclus, sans limite de notes.

Les notes se lient entre elles par [[wiki-links]], et ces liens sont les arêtes d'une vue graphe où la luminosité d'un nœud suit la fraîcheur de la note. Le savoir qui se périme s'estompe visiblement sur un horizon de soixante jours, ce qui règle à peu de frais le mode de panne qui plombe l'approche CLAUDE.md.

La capture se fait à trois moments : au fil de l'eau après tout résultat significatif, à la fin de chaque tour pour les agents en « Toujours mémoriser », et via une question quand tu fermes un agent dont la session est encore vivante. Ce dernier point compte plus qu'il n'en a l'air. Le moment où le savoir s'évapore d'habitude devient celui où il s'écrit.

Deux limites honnêtes. C'est desktop uniquement aujourd'hui, sans application mobile. Et les lectures et écritures des agents passent par le serveur, donc les agents ont besoin de connexion, même si l'interface desktop continue d'afficher tes notes depuis un cache local hors ligne.

Le motif que personne ne dit à voix haute

Regarde où l'industrie a atterri et quelque chose se met en place.

L'outil mémoire d'Anthropic est une interface de système de fichiers. La mémoire automatique de Claude Code est un dossier de Markdown. Les blocs mémoire de Letta sont des chaînes éditables. basic-memory, c'est littéralement du Markdown sur disque. Pendant ce temps, les bases vectorielles et les graphes dominent la couche applicative multi-utilisateurs, celle où tu sers de la mémoire à des milliers d'utilisateurs finaux.

Des fichiers pour l'agent de code. Des bases de données pour le produit.

Si tu construis une application grand public avec une mémoire par utilisateur, tu veux mem0 ou Zep. Si tu cherches juste à empêcher ton agent de code de relire ton dépôt tous les matins, un stockage structuré, en forme de fichiers, lisible par un humain, est presque toujours le bon choix, et la seule vraie question devient qui l'écrit et qui peut le voir.

Sur la portabilité, enfin : il n'y en a pas. MCP est le standard de fait pour le transport, donné à l'Agentic AI Foundation de la Linux Foundation en décembre 2025. AGENTS.md est le standard de fait pour les instructions écrites par des humains. Pour le contenu de la mémoire, il n'existe aucun standard ni format d'échange. Passer de mem0 à Zep, Letta ou Cognee veut dire tout réingérer. Intègre ça à toute décision censée vivre plus d'un an.

Comment choisir, concrètement

Seul, un projet, petite codebase. Soigne ton CLAUDE.md. C'est tout. N'achète rien.

Seul, plusieurs projets, des agents tous les jours. Il te faut une capture automatique, parce que tu ne maintiendras pas cinq fichiers à la main. Project Memory ou basic-memory.

Une équipe ou une agence. Le partage est tout le problème. Pose la question du coût pour que la sixième personne voie ce que l'agent de la première a appris. Avec Obsidian Sync, c'est un siège payant de plus. Avec Project Memory, c'est un git clone.

Tu construis un produit avec une mémoire par utilisateur. Autre catégorie. mem0, Zep ou Letta, et lis les licences pour de vrai.

Tu as besoin de savoir ce qui était vrai au trimestre dernier. Graphiti, et rien d'autre ne rivalise vraiment.

Quoi que tu choisisses, le mode de panne est toujours le même, et ce n'est pas la récupération. C'est une mémoire à laquelle personne ne fait confiance, parce qu'elle est périmée et qu'aucun signal ne le dit. Quel que soit l'outil retenu, la première question à poser est : comment je saurai que ceci n'est plus à jour ? Si la réponse est « je finirai bien par le remarquer », tu t'es trompé.

Une fois la mémoire réglée, la chose suivante qui dégrade discrètement la qualité d'un agent, c'est la dérive de contexte à l'intérieur d'une même longue session. L'astuce du canari la détecte en une ligne.

Télécharger AgentsRoom

Lancez vos agents IA (Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code) sur tous vos projets, depuis une seule fenêtre.

GratuitTélécharger AgentsRoom

App companion : suivez vos agents en déplacement

Utilisez Claude, Codex, Antigravity CLI ou un autre fournisseur IA.

Installer l'extension
Chrome Web Store

Remontez bugs et demandes directement dans votre backlog public.

Aperçu d'AgentsRoom en action.

Multi-projets
Multi-provider
Multi-agents
Statut en direct
Diff & commit
App mobile
Aperçu live
Équipes d'agents
Tests navigateur
Dev pilotée par backlog
Bibliothèque de prompts
Bibliothèque de skills
Voir toutes les fonctionnalités