NeFut Logo NeFut
EN 管理员登录

[AI学术] 信任证据而非代理:可验证证据门控生命周期控制的循环工程

发布于:2026-07-18 22:00 最后更新:2026-07-22 01:24
#algorithm #C++ #Open Source

摘要

自主编码代理越来越多地执行多步骤的软件工作,但生命周期状态如审核、测试、完成和准备合并等仍需当前证据支持。我们提出了Proof-or-Stop生命周期控制方法,该方法仅在新鲜、跟踪源状态绑定的、机械可验证的证据满足相关门控时允许生命周期转换。该方法将代理输出视为声明,而非生命周期状态,并将证明在操作上理解为在特定信任模型下的门控可接受证据,而非语义程序的正确性。

方法评估

我们通过机制测试、控制策略消融和自我应用证据对一个开源实现进行了评估。无人循环引擎在10个场景中全部通过,零假完成,而本地密钥收据包拒绝了18类篡改,零假接受。在9240个单元的消融实验中,预注册的A4与A2-prime的比较将可见通过/隐藏失败的放大从1800个注入单元中的31减少到1800个中的2,未放大率提高了1.6个百分点,95%置信区间为[0.8, 2.5]。

在近计算的A3与A4比较中,1800个中的14与2,表明这一增益与将审核作为生命周期门控的强制执行相关,而不仅仅是增加审核者。自我应用语料库包含565个故事和1007个审核发现,94.8%已解决,此外还有68行高/关键跨供应商展品。这些结果支持Proof-or-Stop作为一个模型无关、主机中立的控制层,用于决定哪些自主代理声明可以采取生命周期行动。评估仅限于一个模型系列、24个消融任务和自托管语料库。

博主点评: 该论文展示了一种新颖的生命周期控制方法,通过引入可验证的证据门控机制,提升了自主编码代理的可靠性。研究结果表明,强制审核作为生命周期门控的策略显著减少了错误判断,具有广泛的应用潜力,值得在实际场景中进一步探索。

原文链接: https://arxiv.org/abs/2607.14890

[h] 返回首页