主题概况

Coding Agents

第 5 / 16 页
趋势
88
想法
102
最近一期
2026-07-23
想法 · 日 · 2026-06-22 · Software Intelligence

编码代理就绪检查

编码代理采用有三个实际压力点:恢复仓库任务真正需要的文件,按已交付的 workplace 制品测试代理,并在部署前检查 AI 构建的应用。证据支持一些小的运营变更,团队可以用现有代码库、会话日志和安全评审队列来试点。

趋势 · 周 · 2026-W25 · Software Intelligence

编码智能体需要轨迹、gate 和范围化记忆来赢得信任

本周的大语言模型(LLM)智能体工作把自主性当作证据问题处理。最有力的声明把任务成功与轨迹、可执行测试、范围化权限和有来源支撑的记忆配对。ProcGrep、SWE-Future 和 Machine Studying 显示了当前重点:根据智能体做了什么、知道什么,以及哪些检查成立来评判它们。

想法 · 周 · 2026-W25 · Software Intelligence

代码智能体验收控制

代码智能体采用正在转向具体的验收检查:经过失败测试的仓库指令、围绕智能体工作的轨迹门禁,以及面向陌生语料的分配前考试。有用工作位于模型周围的支持层:智能体被告知了什么、它实际做了什么、它使用了哪些证据,以及在人类评审结果前通过了哪些检查。

想法 · 日 · 2026-06-20 · Software Intelligence

内部智能体的运行控制

智能体采用正在转向模型周边的运行控制:任务租约、证据包、带来源的记忆、API 调用检查和带身份信息的日志。实际工作是在现有开发者和内部工具工作流中加入这些控制,使失败可见且测试成本较低。

想法 · 日 · 2026-06-19 · Software Intelligence

受控智能体运营

智能体团队现在有了可测试的具体控制模式:用于过期状态故障的确定性重放、用于多文件安全缺陷的发布前源码审计,以及用于常规知识工作的会话锁定模型路由。公开证据大多来自产品或文章主张,因此更有用的做法是开展范围较窄的本地试验,并衡量误报、成本、延迟和回滚行为。