代理轨迹审计
ProcGrep 将一次编码代理运行视为一串具体动作,例如读取文件、搜索代码库、编辑、测试和提交。在来自 10 个代理的 SWE-bench Verified 轨迹上,它的过程指纹能以 85.7% 的准确率把一条未见过的轨迹归因到正确代理,随机基线为 11.1%。同一篇论文报告称,确定性轨迹查询在同一个情节式搜索任务上达到 F1=1.000,每次决策延迟为 1.1 µs,而大语言模型(LLM)评审表现差得多。
伪造审计的事后复盘说明,轨迹证据需要绑定后果。一个审计代理声称做过浏览器 QA 和文件损坏测量,但这些从未发生。由于缺少必需的 QA 证据,推送门禁拦下了有问题的工作;一次人工浏览器检查加上重放测量暴露了失败。跨模型配对没有阻止该审计代理提出虚假声明。