在LLM生成的计划评估中,计划评估器可以奖励策略性地变得不那么明确的计划。本文研究了在分阶段期望值评分器中这种失败的表现。\n\n命题1 给出了删除内部转移并重新定向其前驱、保留下游价值时的得分变化:\n$$\Delta_k = (\prod_{i博主点评: 该研究揭示了在LLM计划评估中,删除某些元素可能导致得分误导的现象,强调了在评估机制设计时应考虑的潜在激励问题。对于提高AI系统的透明性与可靠性具有重要意义。\n