主题概况

Agent Memory

第 2 / 2 页
趋势
9
想法
11
最近一期
2026-07-13
想法 · 日 · 2026-06-10 · Software Intelligence

Coding Agent Control Points

编码代理的采用正在转向具体控制点:用打分的 harness 运行来区分模型质量和 adapter 设计,用本地仓库记忆在重复失败修改前发出警告,以及为会压制拒绝的代码生成模式加入安全检查。真正有用的工作很具体:固定评估契约,把项目状态记录在聊天窗口之外,并在 decoder 设置进入开发流程之前先测试它们。

想法 · 日 · 2026-06-04 · Software Intelligence

Coding Agent Feedback Loops

编码代理评估在记录完整运行循环后更有用:请求、轨迹、反馈、harness 变更和下一次尝试。实际工作是围绕失败轨迹、浏览器可见的 UI 行为,以及经过测量的仓库记忆做小型评估器,然后再把代理使用范围扩大到更多团队。

趋势 · 日 · 2026-05-25 · Software Intelligence

编码代理正在按记忆质量、仓库推理和可执行安全来接受评判

当天最强的研究信号是编码代理的运行控制。CODESKILL 和 SETUPX 显示,可复用经验能带来可测的提升。RepoMirage 说明,当仓库线索需要跨文件推理时,很多代理仍然会卡住。安全和验证论文把同样的要求说得更具体:代理动作需要受限权限、独立检查和机器可读证据。

想法 · 日 · 2026-05-25 · Software Intelligence

Coding Agent Control Layers

可复用的安装记忆、仓库结构检查和提示注入命令测试,已经适合在编码代理工作流里做小规模试验。共同模式很简单:保持主编码模型不变,在它已经在做的工作外面加一层窄控制层,再衡量这一层是否提高通过率、文件选择或命令安全性。

趋势 · 日 · 2026-04-11 · Software Intelligence

编码代理研究正在把结构和外部检查变成主要控制面

这一天的研究表明,编码代理在控制被写下来并在模型外检查时会更好。最清楚的证据来自形式化规格、架构描述文件、harness 管理的内存和预算化评估。还有一个应用系统结果也很突出:LLM 引导的查询计划编辑在 Apache DataFusion 中带来了可测量的速度和内存收益。

想法 · 日 · 2026-04-11 · Software Intelligence

Agent Runtime Infrastructure

这些证据里最清楚的可落地变化,是用于代码导航的结构化文件、代理 harness 里的记忆控制,以及在 Apache DataFusion 中经过执行验证的计划重写。每一项都给出了一种具体的构建或流程改动,并带有可测量的效果;更宽泛的结对编程和基准论文,更适合作为支持性背景,而不是立刻要做的产品方向。