Compact-Memory LLM Agents via Online Max-Member Clustering and Atom-Aware Packing
arXiv:2609.04915v1 提出名为 RSM-full 的在线聚类记忆管道,旨在解决长程大模型部署中提示词预算紧张的问题。该方案结合余弦门控最大成员合并写入规则与原子感知分组上下文打包器,在 AMA-Bench 基准上实现了 $83\%$ 的全上下文质量,同时仅消耗 $32\%$ 的 token 成本(预算为 $4k$)。实验显示,RSM-full 在四种子集平均下优于最近的流式聚类基线(Online K-Means),提升幅度为 $+3.5$--$6.0$pp;消融实验证实性能增益主要源于合并规则与分组打包器。此外,该模式在独立基准 RealMem 上同样有效,显著优于 Streaming-Proto 和 A-MEM,并与 BM25-RAG 持平。研究结论表明,在紧凑记忆模式下,流式记忆的合并方式…