Forgetting Without Restarting: Execution-State Unlearning for Stateful LLM Agents
研究人员提出“执行状态遗忘”概念,旨在让长运行 LLM 代理在收到遗忘请求后表现得仿佛从未观察过目标信息。该方法通过跨层协议(涵盖提示、压缩记忆和缓存),利用溯源图定位注入点、KV 缓存裁剪及清洗回放来恢复反事实后缀。实验表明,仅删除明文记忆无法消除泄露;基于指令的遗忘在诱导测试下完全失效(Leak@probes = 1.00);而选择性回放技术在最多 9 倍更少的重计算 token 下,效果与完全重置无异。