编码 agent 正在按控制、记忆和成本来衡量
本周的大语言模型 (LLM) 编码工作把自主性当作运维问题处理。Claw-SWE-Bench、Trace 和 PROJECTMEM 显示了重点:公平比较 agent harness,在运行时执行用户规则,并在跨会话中保留项目状态。
本周的大语言模型 (LLM) 编码工作把自主性当作运维问题处理。Claw-SWE-Bench、Trace 和 PROJECTMEM 显示了重点:公平比较 agent harness,在运行时执行用户规则,并在跨会话中保留项目状态。