Cold Memory
Étage d'archivage du contexte : la base de connaissances de référence, non chargée par défaut mais récupérée à la demande.
SFEIR AI · Mis à jour le 26 août 2026
La base de connaissances de référence
Cold Memory désigne l'étage d'archivage du contexte d'un agent : le savoir de référence volumineux, non chargé par défaut mais récupéré à la demande, typiquement par une recherche documentaire (RAG). L'agent va y chercher une information précise sans la garder en permanence en contexte. C'est l'étage de plus grande capacité, au coût par requête le plus faible et à l'accès le plus lent.
Ce qu'en dit la publication de référence
« Codified Context », d'Aristidis Vasilopoulos (arXiv, 24 février 2026), en donne une mise en œuvre chiffrée : une base de connaissances en cold memory de 34 documents de spécification récupérés à la demande, troisième composant d'une infrastructure déployée sur un système C# de 108 000 lignes, aux côtés d'une constitution en hot memory et de 19 agents spécialisés par domaine.
Comme pour les autres étages, le vocabulaire relève de l'usage plutôt que d'une taxonomie établie : MemGPT emploie « archival memory » pour un concept voisin. La frontière avec l'étage intermédiaire n'est pas stable non plus, un même magasin vectoriel étant classé tantôt dans l'un, tantôt dans l'autre selon les auteurs.
Questions fréquentes
Qu'est-ce que la Cold Memory ?
L'étage d'archivage du contexte d'un agent : le savoir de référence conservé hors contexte et récupéré à la demande, typiquement via du RAG. C'est l'étage de plus grande capacité, au coût par requête le plus faible.
Qui a défini ce terme ?
Aucun auteur unique. C'est une analogie au stockage d'archivage, employée par plusieurs praticiens. La publication « Codified Context » en donne une définition opérationnelle : 34 documents de spécification récupérés à la demande.
Quelle différence avec la Warm Memory ?
La Cold Memory est persistante et d'accès lent, la Warm Memory d'accès rapide. Mais la frontière varie selon les auteurs : un magasin vectoriel est classé tantôt dans l'un, tantôt dans l'autre, sans source de référence pour trancher.
Cold Memory et RAG, est-ce la même chose ?
Non. La recherche documentaire est le mécanisme d'accès à cet étage, pas l'étage lui-même. On peut alimenter une Cold Memory sans RAG, par exemple en récupérant des documents nommés explicitement par l'agent.
Sources
- arXiv — Codified Context: Infrastructure for AI Agents in a Complex Codebase (Aristidis Vasilopoulos) · 2026-02-24
a cold-memory knowledge base of 34 on-demand specification documents
- arXiv — MemGPT: Towards LLMs as Operating Systems · 2023-10-12
Articles liés
Architecture 3-Tier du contexte : Hot, Warm et Cold Memory
Le paradoxe du prompt vide : quand 80 % du travail se fait avant d'écrire Une étude portant sur 283 sessions de travail avec des agents IA révèle un chiffre qui devrait faire réfléchir tout architecte logiciel : l'infrastructure contextuelle représente désormais 24,2 % de la doc...
Agentic coding sur de grandes bases de code : le vrai problème n'est pas l'agent, c'est la mémoire
Agentic coding sur de grandes bases de code : le vrai goulot, c'est lire le code existant — donnez le contexte du dépôt à l'agent.
Le CDLC : traiter le contexte comme une dépendance logicielle
Le paradoxe du prompt vide : quand 80 % du travail se passe avant d'écrire Vous avez probablement déjà vécu cette situation : un développeur passe une heure à peaufiner un prompt, obtient un résultat médiocre, reformule, recommence, et finit par se demander si l'IA tient vraimen...