Récupération à trois couches résistante aux pertes ★ En direct
La compression de faits du contexte actif conserve environ 100 % des faits utiles, là où la compaction générique ne conserve que ~40 %. La récupération de mémoire à long terme est une discipline distincte et plus difficile — évaluée ouvertement.
Un pipeline de rappel à trois couches (L1+L2+L3) reconstruit le contexte même après de longues périodes d'interruption. Deux disciplines distinctes, énoncées avec franchise. (1) Compression du contexte ACTIF : remplacer la compaction générique par notre compression basée sur les faits utiles conserve ~100% des faits dans la même fenêtre de contexte, contre ~40% avec une compaction de style résumé — une mesure de qualité des données pour laquelle un banc d'essai reproductible est en cours de finalisation sur notre plateforme publique. (2) Récupération depuis la MÉMOIRE à long terme — à travers diverses sources et fenêtres de validité temporelle — est un problème plus difficile mesuré séparément (LoCoMo, LongMemEval) ; les chiffres y sont honnêtes, non gonflés — coût en jetons inférieur, latence réduite, rien d'important perdu.