State and authority controls for agents
几篇工作都把大语言模型(LLM)代理看作受控运行时的一部分。STORM 会在代理读到过期文件后拒绝写入,然后返回新上下文,让代理重试。生产代理架构论文在工具边界上给出了同样的思路:模型提出方案,确定性代码做验证,接受的动作被提交,拒绝的动作会得到带类型的反馈。Capframe 用 Model Context Protocol(MCP)给出这个思路的具体版本,配合限定范围的能力令牌和对工具调用的确定性策略检查。
共同的问题很实际。并行代理会互相覆盖,或基于旧假设执行。使用工具的代理也可能拿到过多权限。这组工作里最强的方案,都在模型周围加了版本检查、提交规则、拒绝回执和审计记录。