Различает контекст (в окне модели) и память (вне модели), а также два измерения памяти: срок жизни (краткосрочная, рабочая, долгосрочная) и тип содержимого (семантическая, эпизодическая, процедурная). В 80% случаев достаточно связки краткосрочной и долгосрочной семантической памяти. Описывает уровни памяти: уровень 0 — простое хранение истории диалога, недостаточное из-за дубликатов и отсутствия консолидации; уровень 1 — векторный поиск с использованием pgvector, Qdrant, Milvus, Pinecone; уровень 2 — структурированная память с SQL и графами, например Graphiti. Ключевая ошибка — сохранять сырые реплики, правильно — извлекать факты и поддерживать двухслойную модель с исходниками и извлеченными данными.