用于 GitHub issue 修复的 Explorer、Patch Editor、Validator 分离工作流
在仓库 issue 上使用编码代理的团队,可以把修复循环拆成三个角色:Explorer 查找文件、函数和调用链;Patch Editor 修改代码;Validator 编写并运行复现测试和回归测试。关键控制点是补丁编写和验证之间的边界。i cat-agent 向 Patch Editor 隐藏测试代码和断言,同时让代理之间传递结构化事件,例如通过/失败结果和可疑语句。
这种做法适合遇到以下问题的团队:代理通过自己编写的弱测试,或在较长的 issue 线程中丢失上下文。可以先做一个小型 issue 质量门禁:如果工单写明文件、函数、修复策略和复现步骤,就直接送入补丁编写和验证;如果缺少这些信息,就先运行探索。在 SWE-bench Pro 上,使用 GPT-5.4-xhigh 的 i cat-agent 解决了 67.4% 的任务,比使用同一模型的 mini-SWE-agent 高 8.3 个百分点。论文还报告,在该基准上它的平均单实例成本低于 Claude Code。