智迹闻AuraTracer
EN

EVENT DOSSIER

通过在线最大成员聚类和原子感知打包实现的紧凑型内存LLM智能体

2026-09-07 12:00 大模型 🔥 42.2 事件热度
1家信源
1天持续发酵
42.2事件热度
1个提及
摘要由 AI 生成

2026 年 9 月 7 日,arXiv 发布论文《Compact-Memory LLM Agents via Online Max-Member Clustering and Atom-Aware Packing》,提出名为 RSM-full 的在线聚类记忆管道。该方案旨在解决长程大模型部署中提示词预算紧张的问题,结合余弦门控最大成员合并写入规则与原子感知分组上下文打包器。在 AMA-Bench 基准测试中,RSM-full 实现了 83% 的全上下文质量,同时仅消耗 32% 的 token 成本(预算为 4k),优于最近的流式聚类基线 Online K-Means,平均提升幅度为 3.5 至 6.0pp。消融实验证实性能增益主要源于合并规则与分组打包器。此外,该模式在独立基准 RealMem 上同样有效,…

相关事件RELATED EVENTS
关键实体KEY ENTITIES
RSM-full

信号强度SIGNALS

关键词热度
  • RSM-full1

全部报道(1)SOURCES

A arXiv cs.AI en 2026-09-07 12:00

Compact-Memory LLM Agents via Online Max-Member Clustering and Atom-Aware Packing

arXiv:2609.04915v1 提出名为 RSM-full 的在线聚类记忆管道,旨在解决长程大模型部署中提示词预算紧张的问题。该方案结合余弦门控最大成员合并写入规则与原子感知分组上下文打包器,在 AMA-Bench 基准上实现了 $83\%$ 的全上下文质量,同时仅消耗 $32\%$ 的 token 成本(预算为 $4k$)。实验显示,RSM-full 在四种子集平均下优于最近的流式聚类基线(Online K-Means),提升幅度为 $+3.5$--$6.0$pp;消融实验证实性能增益主要源于合并规则与分组打包器。此外,该模式在独立基准 RealMem 上同样有效,显著优于 Streaming-Proto 和 A-MEM,并与 BM25-RAG 持平。研究结论表明,在紧凑记忆模式下,流式记忆的合并方式…