摘要
Anchors 是一种流行的局部模型无关解释技术,但因计算效率低下而限制了其适用性。为了解决这一问题,我们提出了一种基于记忆的框架,旨在加速 Anchors,同时保持解释的准确性和可解释性。
我们的方案利用了 Anchors 算法的迭代特性,该算法逐步细化解释,直到对给定输入足够精确。我们通过存储和重用先前解释中获得的中间结果来实现这一点。具体来说,我们维护了一组低精度、高覆盖率的规则,并引入了一种规则转换框架以适应新输入:
- 水平转换:通过替换特征,将预训练的解释适应当前输入。
- 垂直转换:细化一般解释,直到对输入足够精确。
我们在表格、文本和图像数据集上评估了我们的方法,结果表明,它显著减少了解释生成时间,同时保持了准确性和可解释性,从而使 Anchors 在时间敏感的应用中得以实际采用。
博主点评: MAnchors 的方法通过记忆存储和规则转换有效提升了 Anchors 的计算效率,展现了在多种数据集上的广泛适用性。这为时间敏感的任务提供了新的解决思路,值得研究者关注与深入探讨。