MEM·ENG 7-DAY MEMORY ENGINEERING
学习 · 7天路径 技能 · 记忆实验室 社区 · 协作生态 全部资源导航
module 04 // ecosystem

全部资源导航

记忆工程生态全景:框架与库、里程碑论文、评估指标体系、官方文档直达。

frameworks // 记忆框架与库

框架对比矩阵

框架 / 库语言核心能力适用场景
Letta(原 MemGPT)PythonOS 式分层记忆、分页调度、持久化复杂 Agent、长对话
LangGraphPython / JSCheckpointer、State 管理、MemorySaver工作流 Agent、可恢复状态
LlamaIndexPython向量索引、KG 集成、复合检索RAG + 记忆系统
Mem0Python自适应用户记忆、多层级存储个性化 AI 助手
ZepPython / Cloud长期记忆服务、自动摘要、实体提取对话式 AI 记忆后端
ChromaPython轻量向量存储、嵌入管理原型开发、中小规模
Milvus / ZillizPython / Go分布式向量数据库、十亿级规模企业级 RAG
Neo4j + LLMPython知识图谱记忆、关系推理结构化知识记忆
papers // 里程碑论文

记忆增强论文与技术报告

2023 · UIST

Generative Agents: Interactive Simulacra of Human Behavior

斯坦福小镇:记忆流(Memory Stream)+ 反思(Reflection)+ 规划(Planning)三层架构的奠基之作。

Park et al. · arXiv:2304.03442
2023

MemGPT: Towards LLMs as Operating Systems

操作系统式分层记忆管理:主上下文 / 外部上下文、分页调度与中断机制(现演化为 Letta)。

Packer et al. · arXiv:2310.08560
2023 · NeurIPS

Reflexion: Language Agents with Verbal Reinforcement Learning

自我反思生成经验摘要写入长期记忆,以语言强化学习指导 Agent 未来行为。

Shinn et al. · arXiv:2303.11366
2024 · NeurIPS

HippoRAG: Neurobiologically Inspired Long-Term Memory for LLMs

受海马体索引理论启发的记忆架构:情景记忆与语义记忆的双系统仿生。

Gutiérrez et al. · arXiv:2405.14831
2023

RET-LLM: Towards a General Read-Write Memory for Large Language Models

可读写外部记忆的通用框架:三元组存储 + 别名解析 + 基于相似度的检索更新。

Modarressi et al. · arXiv:2305.10250
2014 · 始祖

Neural Turing Machines

可微分外部记忆的开山之作:神经网络通过注意力读写记忆矩阵,一切记忆增强架构的思想源头。

Graves et al. · arXiv:1410.5401
2019

Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context

片段级递归与相对位置编码,让 Transformer 突破固定上下文长度。

Dai et al. · arXiv:1901.02860
2024 · 前沿

Memory Mosaics(模块化记忆架构)

不同记忆类型由不同子网络处理的模块化记忆专家架构,Day 7 前沿章节重点拆解对象。

Ding et al. · 社区共读会候选篇目
metrics // 评估基准与指标

记忆系统评估指标体系

记忆召回率

相关记忆被成功检索的比例 —— Recall@K 的记忆系统版本。

记忆精确率

检索到的记忆中相关记忆的比例,直接决定上下文噪声水平。

上下文利用率

检索到的记忆在最终生成中被实际引用的比例。

记忆一致性

跨时间记忆的事实一致性(无矛盾),可用一致性检查器自动扫描。

个性化准确度

Agent 输出符合用户偏好的程度,偏好记忆质量的直接度量。

Token 效率

记忆检索带来的性能提升 vs 增加的 Token 成本,生产环境的关键 ROI 指标。

团队记忆同步率

多 Agent 间共享记忆的更新一致性(Day 6 团队记忆核心指标)。

记忆冲突解决率

自动检测并成功解决的记忆冲突占总冲突的占比。