NeFut Logo NeFut
EN 管理员登录

[AI学术] 空间准确、时间不可靠:LLM 如何呈现国家文化变迁

发布于:2026-09-04 22:00 最后更新:2026-09-05 12:23
#AI #Machine Learning #LLM

评估文化对齐已成为大语言模型(LLM)研发的重要环节。现有评估大多把文化视为单一快照,只检查模型在当前时点是否准确描绘社会。文化心理学研究表明,价值观随时间以不同速率和方向变化,因而真正的“文化感知”模型应同时捕捉当下位置与历史演进。\ \ 本文利用超过二十年的世界价值观调查(World Values Survey)数据,对40个国家在Inglehart‑Welzel文化图上的历史轨迹进行建模,并将其与四种最先进LLM的预测轨迹进行比较。结果显示,模型普遍能将国家定位在最近一次调查的附近,但往往落后数年;对变化幅度的捕捉不足,常在实际变化微弱的地区产生虚假移动,且很少复现出现实中的轨迹逆转。这种“时间平坦化”表明,仅凭快照准确性无法完整评估LLM的文化感知能力,进而影响模型评估、潜在的表征伤害以及面向文化敏感AI系统的治理框架。\ \ 点评

原文链接: https://arxiv.org/abs/2609.01902

[h] 返回首页