NeFut Logo NeFut
EN 管理员登录

[AI学术] 代理行为合同 II:在不假设独立性的情况下证明组合可靠性

发布于:2026-08-14 22:00 最后更新:2026-08-16 07:03
#algorithm #Machine Learning #Artificial Intelligence

最近的一项研究致力于检验多代理系统中组合可靠性界限的假设。通常,这些界限是通过将各个组件的可靠性相乘而得到的,这一步骤依赖于条件独立性假设。然而,这个假设经常被声明却很少被测试。通过对18,000次任务的评估,研究人员发现两个实例中的一个模型在双代理交接中共失败的比例高达90.0%(log OR 6.66,95% CI [6.38, 7.00];phi 0.916)。此外,替换不同的模型会降低这种关联性,而替换不同的供应商则不会产生显著影响。这种错误是有符号的,并且对操作员不利:正依赖性会使联合故障率超过独立性产物,因此冗余会在组件共享模型时被过度信用。研究人员证明了一个引导式界限,表明使用更多数据会使这种证书变得更糟。他们提出了一个假设无依赖结构的有限样本证书,使用线性程序来覆盖联合和Bonferroni-Clopper-Pearson盒中的测量协执行时刻。该证书是合理的、针对所提供信息的尖锐的,并且在时刻家族中是单调的。丰富十个时刻函数到十四个会将确定的间隔缩小85.7%并将认证的底部从0.2455提高到0.4116。一个伴随的任何时候都有效的证书在可选停止下保持类型I错误为0.0471。 博主点评: 本研究揭示了多代理系统中组合可靠性界限的假设可能并不总是成立,并且提供了一个假设无依赖结构的有限样本证书。这些发现对于改进多代理系统的设计和评估具有重要意义,特别是在组件共享模型的情况下。未来研究可以进一步探索组合可靠性界限的假设和证书的有效性。

原文链接: https://arxiv.org/abs/2608.12895

[h] 返回首页