摘要
AI的发展面临着虚构依赖的问题。开发者将现代书籍(包括虚构作品)的大型语料库视为具有足够价值的资源,愿意接受巨大的成本和法律风险,但当前模型在生成引人入胜的长篇虚构作品方面仍然面临挑战。我称之为“AI-虚构悖论”,这一现象尤其引人注目,因为训练数据显著影响模型输出。
三大挑战
本文提供了对虚构作品为何难以被AI生成的理论性解释,识别出当前系统面临的三大挑战:
-
叙事因果性:虚构作品依赖于一种我称之为叙事因果性的情节逻辑,要求事件在瞬间感到惊讶,同时在事后显得不可避免。标准的自回归生成方式是按序生成文本,这在长叙事中使得局部的惊讶感与事后的必然性之间协调变得困难。
-
信息重估挑战:虚构作品需要不断地根据后续发展重新解读早期细节的意义,这种长程推理当前系统的表现不够可靠。
-
情感架构:基于我七年的情感弧研究,虚构作品需要多层次的情感架构,在字、句、场景和弧的层面上同时进行情感的编排。
这三大挑战共同解释了开发者为何寻求大型现代书籍语料库,以及为何生成引人入胜的长篇虚构作品仍然如此困难。分析还引发了一个紧迫的问题:当这些挑战被克服时会发生什么。虚构作品集中展示了强大的认知和情感模式用于建模人类行为,而AI系统掌握这些模式不仅是创造性的成就,更是大规模操控人类的有力工具。
博主点评: 本文深刻揭示了AI生成虚构文学的复杂性,尤其是叙事因果性和情感架构的挑战。这不仅是技术上的难题,也涉及伦理和社会影响,值得开发者深入思考。未来AI在虚构领域的突破,将可能改变人类对文学的理解与体验。