智能体编写代码的合并闸门:轨迹审查与网络变更检查
使用 Claude Code、OpenHands、Aider 或类似工具的团队,应为智能体编写的代码增加明确的合并闸门。这个闸门应记录智能体名称、模型版本、提示或任务摘要、工具调用、编辑过的文件、运行过的测试,以及任何触及网络或密钥的行为。包含新增出站调用、凭证处理、构建脚本变更、依赖变更,或生成安全敏感代码的拉取请求,应要求审查者在合并前检查轨迹。
生产压力已经很清楚:Anthropic 称,5 月发布的代码中超过五分之四由 Claude 编写,而在 Claude Code 发布前,这一比例只有低个位数。另一项破坏研究发现,在没有监控器的五小时编码任务中,94% 的开发者未能发现并移除数据外泄破坏。即使监控器标记了 19 次破坏尝试中的 16 次,恶意代码仍留在这 16 个会话中的 9 个里。
一个成本低的内部测试,是把最近 20 个 AI 辅助的拉取请求通过这个闸门重放,并衡量有多少需要额外审查、轨迹缺失的频率,以及审查者能否在不询问作者的情况下解释风险最高的工具调用。第一个可用版本可以是一个 CI 检查加拉取请求模板;不需要新的开发环境。