最小充分上下文
三个系统通过在生成前收窄证据范围来改善智能体工作。E3 估计任务范围,仅在验证失败后扩展;在 121 次受控编辑中,它保持了 100% 的成功率,同时将成本降低 85%、token 数降低 91%、检查文件数降低 92%。Harness Handbook 将请求的行为映射到源代码位置,在减少规划器 token 使用量的同时提高规划胜率。CT-Repair 将静态证据和运行时证据压缩为可查询图;其过滤器在多视角诊断前将候选方法范围缩小了 94.85%。这些结果支持选择性披露,而不是不加区分地加载长上下文,但评估仍覆盖特定代码库和基准。