可编辑的代理上下文
Context Sculpting 测试了一个双模型框架,较强的外层模型可以重写较弱任务代理的工作上下文。这个设置有用,因为长时间运行的代理常会带着过时文件、失败路径、工具噪声和干扰证据。
结果支持可行性,但成本上限很清楚。在第一个演示里,8 次运行全部通过验证,框架没有做任何重写。在更嘈杂的第二个演示里,外层代理在 2 次受框架约束的运行中做了 14 次上下文重写。编码修复示例在两种形式下都通过了:对照组用了 7 轮、42.7 秒、约 0.015 美元;受框架约束的运行用了 12 轮、566.9 秒、约 1.06 美元,并触发了最大轮次护栏。结果给出一个直接的提醒:上下文编辑能起作用,但策略选择会让它很快变贵。