摘要
大型语言模型(LLMs)正在快速提升,基准分数体现了这一进展。然而,这些AI基准主要测试事实回忆、狭义问题回答、数学问题解决、编码及工具使用等能力。相对而言,AI在白领专业人士日常执行的分析知识工作方面的进展仍然测量不足,包括综合复杂信息、在不确定和不完整信息下行使判断、在多利益相关者环境中应用战略和对抗性思维、权衡利弊以及产生有据可依的结构化分析。这种测量缺口在这些工作的主观成分上尤为明显,成功的定义往往具有挑战性。
顶级商学院实践的“案例法”教育为解决这一测量缺口提供了自然基础。我们构建了 BusinessCaseBench,这是一个涵盖来自十八个学科的商业案例的数百个问题的基准,每个问题都配有来自专家编写的讲师案例解决方案的评分标准。在 BusinessCaseBench 上,前沿AI模型已经在讲师评分标准下获得了高分,并且同一模型系列的能力在两年内显著提高。这些结果强有力地证明,AI在这一类工作中的表现已经很高且迅速改善,对商学院有重要意义,因为案例教学法在本科生和MBA中培养这种分析推理能力,同时也对入门级专业角色产生影响,这种技能在早期职业工作中历来是基础所在。
博主点评: 该研究揭示了AI在复杂分析任务中的潜力,尤其是在商业教育与职场应用中,表明AI的快速进步值得关注。随着AI能力的提升,商业教育应更深入地融合此类技术,以培养适应未来职场的专业人才。