Grounding Agent Memory: Environment-Probing Curation for Enterprise Agents¶
复现级别:L1 核心机制诊断。 本地执行重复探测、冲突拒绝和记忆准入;未连接 GitHub Copilot SDK。
论文信息¶
| 字段 | 内容 |
|---|---|
| 论文链接 | Grounding Agent Memory: Environment-Probing Curation for Enterprise Agents |
| 公司/机构 | Microsoft(按第一作者署名单位) |
| 首次公开日期 | 2026-09-09 |
| 原文开源代码 | 否:未找到作者公开仓库(核查日期:2026-09-14) |
| Adapter / 方法 | grounded-memory |
| 本地复现代码 | src/auto_research/agent_research/latest_20260914.py |
原始论文总结¶
背景与主要改动¶
给异步记忆 curator 最小权限只读工具,在写入前验证、限定作用域并刷新候选记忆。
flowchart LR
I[输入与公开状态] --> M[grounded-memory 核心机制]
M --> A[可审计中间量]
A --> O[输出或更新]
原论文关键图¶
原论文 Figure 1(关键图):展示原论文方法的总体设计和关键组成。图片来自原论文,版权归原作者所有;点击图片可查看来源。
核心公式或操作¶
本地代码把论文决定性操作实现为确定性的 reference kernel,并显式输出门控、选择、投影、图边或状态更新统计;测试覆盖公式不变量和边界条件。
论文离线与线上效果¶
CLBench pass rate 39%→73%,查询 8.8→4.7,任务 Agent 成本 \(3.38→\)1.68。 这些数字来自原论文,不与本地缩小实验直接比较;论文未报告线上 A/B 时不推断线上收益。
本地复现¶
三种子指标见 metrics/mechanism-seeds42-44.json。所有候选使用相同公开 fixture、预算和 seed;本页结果只证明核心状态转换实际执行。
复现边界¶
本地执行重复探测、冲突拒绝和记忆准入;未连接 GitHub Copilot SDK。
