完成配对隐藏受限失败的现象在 ReVerPi 的选择性上下文投影实验中得到体现。上下文投影用紧凑、可寻址的摘录替代旧的工具观察,既降低重复输入,又可能增加检索回合。我们在一次 86 次的源阅读实验中发起 641 次模型请求,得到 15 对完整配对,两个分支的成功率相同,均为 12/15。其余 12 次边界运行在首臂未完成时被抑制,未执行伴随臂。若恢复全部 27 次边界运行,投影分支相对完整分支的成功数在 -9 到 +1 之间波动。
一次被省略的、由选择器挑选的投影续写成功检索到归档文本,但耗尽了 12 次请求;对应的完整续写仅用了 3 次请求。共有 11 对同时正确的配对构成了完整观察的成功层面:投影总体逻辑 token 减少 25%,但中位配对的 token 增加 29%,后缀请求总数从 35 增至 55。
将拟合阶段与评估阶段分离后,选择器的表面持平被打破:在其四个拟合配对之外,出现一次额外失败,并在 13 次可比运行中多消耗 8.6% 的逻辑 token。该案例研究将停止规则、已知的有界失败、未执行的伴随臂以及资源聚合联系起来。结论仅适用于本次记录的实验,而非对无限制 Pi 的非劣或优越性推断。未来评估应保留每一次干预边界,独立执行两臂且不受首臂完成情况影响,并报告完成情况、交互次数以及 token 开销。
点评