NeFut Logo NeFut
EN 管理员登录

[AI学术] 可审计的 AI 代理声明

发布于:2026-10-07 22:00 最后更新:2026-10-08 01:25
#algorithm #AI #Machine Learning

组织经常对其 AI 代理作出声明,例如“每封外部邮件都需人工批准”“所有操作都有日志记录”“评估表明该代理安全可部署”。欧盟《AI 法案》第12条要求高风险系统能够自动记录事件,但未规定哪些记录能够满足特定声明。本文提出,要验证一项声明,必须先明确四个要素:适用的政策、声明的范围、能够决定该声明的记录以及记录的编写者。基于保证业务的前置条件,我们将满足这些要素并在判定前固定决策规则的声明称为可审计的。该概念将我们先前的可审计代理框架中的“政策可检查性”维度从单一动作扩展到完整声明。针对 AI 代理,额外加入三条要求:必须有独立记录覆盖、授权必须绑定到每个动作的参数、完整性要求超出单纯的数据完整性。通过显式模型证明,在每个假设成立的情形下,若缺少任意一条条件,声明的支持即不可实现。随后展示了一个“声明检查表”,将方法应用于六类常见声明,这些声明基于当前 NIST、IETF 与 OWASP 草案。文中进一步通过一个案例演示了同一声明在五种证据状态下的演进。最后提供实践要点箱,列出运营者、采购方、审计员和标准制定者的具体步骤。

点评

原文链接: https://arxiv.org/abs/2610.07459

[h] 返回首页