不只是RAG变体!xMemory如何重新定义智能体记忆机制
xMemory 首次将“层级解构 + 信息论指导 + 不确定性扩张”整合成一个端到端的记忆检索框架,在智能体长程对话场景中全面超越了传统RAG方法。作者已基于MIT协议开源代码,下一步计划支持多模态记忆与联邦学习隐私版本,无论是个人助理、游戏NPC还是企业知识库都能灵活应用。
免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈
这项由伦敦国王学院团队提出的xMemory技术,采用“先拆后聚”的层级记忆架构,能够将智能体长程对话中的冗余检索信息削减30%的Token量,同时将问答准确率(QA分数)反而提升超过10分。
RAG 在 Agent 场景的“水土不服”症结
传统方法的问题链条通常是这样:
top-k 相似度检索 → 结果常常混杂大量“车轱辘话”需后续剪枝压缩 → 时间线和指代关系被切断,导致多跳推理直接崩溃
图片
xMemory “拆-聚-检”三步走策略
图片
构建四级记忆树
从原始对话起步,完整保留时间戳与指代关系链。在Episode层面,将连续的消息块通过边界检测与提示词自动分段。在Semantic层面,提炼出可复用的事实单元,例如“用户于2025年1月搬家至西雅图”。在Theme层面,抽象出高阶概念,如“职业规划与家庭关系”。
> 每一层级节点都保持为一个“完整证据单元”,不再进行机械式的片段切割。
引入稀疏-语义综合目标函数
f(P) = SparsityScore + SemScore
SparsityScore:确保各主题分布均衡,避免出现“超级候选集”而淹没关键信息。SemScore:促使语义相近的内容聚集,不同主题分离,有效防止“语义孤岛”现象。
支持在线增量更新:新的语义信息会首先贴附于最近的相关主题,一旦触及阈值即自动进行分裂或合并。数据显示44.9%的节点会被动态重组,这意味着记忆结构越用越有条理。
自顶向下的双阶段检索
第一阶段(骨架选择)在主题-语义层进行贪心选择,优先挑出“覆盖广且相关性高”的代表性节点,并天然去重。
第二阶段(不确定性扩张)则非常克制,只将那些能显著降低LLM预测熵的Episode或原始消息纳入最终检索结果,冗余信息一句也不给。
实验效果验证
Token用量减半,性能分数反升
在跨三款主流LLM(包括Qwen3-8B、Llama-3.1-8B、GPT-5-nano)的测试中,趋势高度一致:模型越小,性能提升幅度越大。
深度解析:为什么效果如此显著?
证据密度实验表明,在xMemory的检索块中“同时命中2个以上答案关键词”的比例提升了2倍,而简单剪枝方案会把多重命中的区块削成单一命中,反而使信息更稀疏。
一张图看清差距
图片
对于同一段长对话,传统RAG需要抓取20个信息块才能覆盖答案,而xMemory仅需5块;简单剪枝虽然Token用少了,却可能把关键细节一起剪掉。
三个实战锦囊
首先,别再盲目调高 top-k 值。智能体记忆具有高度自相关性,k 值越大越冗余。正确的做法是先分层,再用贪心算法选取代表节点,效果立竿见影。
其次,剪枝需慎用。对话证据具有链式耦合性,剪“废话”时容易误剪“前提”。用不确定性阈值门控替代硬性剪枝,能在降低Token用量的同时提升准确率。
最后,结构要“活”。用户会随时更正事实,让主题节点可以动态分裂与合并,记忆才不会“僵化”。
让AI记住你,不再只是“金鱼脑”,也不会变成“话痨”——这正是后RAG时代记忆管理的开端。
论文:Beyond RAG for Agent Memory: Retrieval by Decoupling and Aggregation
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
ATaaS平台发布:如何构建日产能万亿的Token工厂
3月27日,作为2026中关村论坛核心组成部分,由趋境科技与九源智能计算系统生态联合体共同主办的“全栈智能 全域推理:Token爆发元年的全场景大规模推理服务”专题研讨会成功举办。论坛汇聚院士、顶尖
海㡳AI开源新突破!甲子光年解析产业未来
从模型到基础设施,再到社区,开源在海淀意味着什么?作者|周悦编辑|王博“你心目中的AI社区是什么样的?”当主持人提出这一话题,来自AI公司的创业者、开发者、投资人、媒体人、AGI Bar老板,甚至一
华为AI深度布局:如何引领科技变革新格局
新智元报道编辑:艾伦【新智元导读】华为诺亚方舟实验室主任王云鹤官宣离职。我们梳理了王云鹤的经历。王云鹤今日在朋友圈官宣,将辞去华为诺亚方舟实验室主任职位,告别华为。从 2025 年 3 月到今天,王
Claude限流,Altman紧急叫停Sora:AI竞争格局改变
新智元报道编辑:元宇【新智元导读】Sora应用关停,Claude却因太火而被限流:一个烧不起,一个供不上,算力墙面前,AI竞赛的胜负手突然变了。一夜之间,打工人突然发现:Claude开始限流了。An
谷歌内存论文疑被抄袭,华人学者控诉业内学术不公
新智元报道编辑:好困 Aeneas【新智元导读】把闪存股一夜干崩的谷歌顶会论文,出大事了。TurboQuant的核心方法,两年前就被一位华人学者做完、发完顶会、代码全部开源了。谷歌不仅没正面提及,而
- 日榜
- 周榜
- 月榜
相关攻略
2015-03-10 11:25
2015-03-10 11:05
2021-08-04 13:30
2015-03-10 11:22
2015-03-10 12:39
2022-05-16 18:57
2025-05-23 13:43
2025-05-23 14:01
热门教程
- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程

