企业部署的自主 AI 代理沿用了为人类用户和长期服务设计的控制模型,但在三方面失配:代理的主体是短暂的,出现和消失速度快于资源配置;它们的行为由模型而非硬编码决定,事先无法列举可能的动作;代理是通过调用 API 动态产生的,人口是被发现而非预先配置。我们认为治理这些代理是运行时问题,而非模型对齐或构建时问题。为此提出五个必需的原语:发现、身份、治理、证明、供应链。缺失任一原语都会导致系统失效,其他原语无法替代。实现上,代理的每一次动作在生效前先经过策略中介,依据租户的动作词表进行授权,并记录在哈希链接的签名账本中,第三方可在不依赖供应商的情况下验证。架构成本表现为:中介点位于请求关键路径,身份需要为每个工作负载部署 sidecar,失败关闭的中介把可用性故障转化为拒绝。当前四个原语已在私有试点中实现并运行,第五个原语作为独立工具尚未集成到请求路径。我们强调,这一五部分拆解并非分类学,而是对现有代码库的描述。
博主点评:这篇工作把治理自主 AI 代理的核心需求抽象为五个可实现的模块,既点出了传统控制模型的局限,又提供了可落地的实现路径,为企业在实际部署中引入安全审计和可验证的策略执行提供了有价值的参考。