主题概况

AI coding agents

第 1 / 2 页
趋势
6
想法
8
最近一期
2026-W27
想法 · 周 · 2026-W27 · Cross Platform

agent 生成的 Flutter 代码检查

这组材料中的 Antigravity 工作指向两类可用做法:面向 ADK 前端的可复用 skill,以及面向 Flutter 游戏逻辑的检查辅助工具。共同的采用阻碍是对生成代码的信任:当平台行为、流式事件或对时序敏感的物理逻辑在 prompt 之外失败时,团队需要能检查和验证代码。

想法 · 日 · 2026-07-01 · Cross Platform

可审查的 Flutter 生成工作流

这个案例给为 ADK agent 构建 Flutter 客户端的团队提供了一个实用模式:让编码 agent 在写代码前创建可审查的接口、用法、架构和设计文件,再把每次失败运行的修复写入可复用技能。最明确的构建目标是一个小型 ADK Flutter 客户端工作流,并带有生成后检查,覆盖平台权限、markdown、流式事件、Web 网络和工具调用显示。

想法 · 日 · 2026-06-16 · Software Intelligence

编码代理验证控制

代理编写的代码需要质量门禁来检查测试实际断言的内容,需要修复循环把有针对性的执行证据传回模型,也需要评估报告区分模型、harness、环境、验证器和技能的影响。共同的操作问题是虚假的信心:PR 可能包含断言很弱的测试,修复代理可能只能看到通过/失败反馈,而排行榜分数可能隐藏能让结果产生两位数百分点变化的 harness 选择。

趋势 · 日 · 2026-05-23 · Software Intelligence

AI engineering tools are being judged by retention, guardrails, and control paths

当天最强的信号是 AI 工程工具的运营层证据。Gemini for Google 显示了某家公司内部的实测提升;The Polyglot Protocol 把审查习惯写成规则;Resident 把设备代理收进沙箱本地应用。同一组材料也把更新渠道、管理员控制、流失率和源码映射当作技术评估的一部分。

想法 · 日 · 2026-05-10 · Software Intelligence

Agent Failure-Mode Gates

Agent 软件工作正在转向与具体失败模式绑定的检查:会返回看似合理却错误结果的实时工具调用、用狭窄攻击集测试的监控器,以及顺序测试漏掉共享内存交互的 C/C++ 库。实际工作是在这些流程前面加小门槛,避免 agent 直接接触生产系统或安全关键仓库。