Commit-linked coding-agent scorecards for kept code and review friction
使用编码代理的团队需要一份面向提交的评分卡,衡量开发者保留了什么、丢弃了什么,以及代理带来了多少审查阻力。SWE-chat 提供了最清楚的例子。大约 6,000 次真实会话里,代理写出的代码总体保留率是 50.3%,协作会话降到 44.1%。用户在 39% 的轮次里提出了反对,vibe coding 的 token 成本更高、每行提交代码耗时更长,引入的漏洞也更多。这些数字支持一个明确的产品改动:在代理日志里加入会话后的归因和提交关联,然后按代码保留率、审查返工、打断率和每行提交代码的安全发现,对提示、仓库和工作流排序。最先会用到这套东西的是那些已经为共享仓库里的编码代理付费、还在争论输出到底有没有帮助的团队。一个低成本试点是做一个 GitHub 应用或 CLI 包装器,把会话轨迹和合并后的 diff 关联起来,在正常使用一周后展示保留率和拒绝率。