摘要
从印刷机到社交媒体,通信技术的创新不断重塑人类文化中的思想传播方式。由生成性人工智能驱动的聊天机器人构成了一种新媒介,通过其神经表征编码文化模式,并在与数亿人对话中传播这些模式。一个基本问题是,这些模式是否会传递到人类语言中,并最终影响人类文化。虽然全面量化像ChatGPT这样的聊天机器人对人类文化的因果影响具有挑战性,但人类口语交流中的词汇变化可能提供早期指标。
我们展示了ChatGPT偏好生成的词汇,如“delve”、“showcase”、“boast”、“intricacies”以及“meticulous”,在自发的人类言语中急剧增加。通过对824,634个播客节目中737,083小时对话进行合成控制分析,筛选出非剧本化的言语,因果关系将这一变化与ChatGPT的发布联系起来。这种对自发言语的可测量影响表明,人类内化了大语言模型(LLMs)的词汇选择。一个预注册实验(N = 496)证实了这一点,因为与聊天机器人的简短互动使参与者将其词汇作为自己的词汇,且这种影响在分心任务后依然存在,并在强制词汇选择中得以确认,表明这些词汇已在活跃词汇中扎根。
这些结果表明,基于人类数据训练的机器现在将自身特征反馈到人类语言中,将LLMs整合进文化进化的持续过程。这种结合引发了对语言同质化的担忧,以及少数主要AI提供商在规模上潜在文化影响的能力。
博主点评: 本文揭示了大语言模型在影响人类语言和文化方面的潜力,强调了技术进步与人类交流之间的复杂关系。随着AI的不断发展,我们需要关注其对语言多样性和文化传承的潜在威胁。