随着具身代理在 VR 中承担越来越多的社交角色,仅靠视觉真实感和具身性已不足以让用户感受到情感契合、支持和类人。已有研究表明语言契合和非语言模仿各自能提升用户对代理的社会评价,但行为模仿大多在非实时、非对话的情境中研究,缺乏对同时生成情境响应对话并实时调整非语言行为的交互的认识。为填补此空白,我们构建了一款具身 AI 咨询师,结合对话式 AI、实时面部表情和姿势模仿,并可输出语言契合或中性回应。我们在 20 名参与者中进行 2×2 组内实验,分别操控语言契合(契合/中性)和行为模仿(有/无)。结果显示,语言契合是提升感知共情的最可靠因素。行为模仿与感知类人性呈边际正相关,且更高的模仿曝光在女性参与者中与共情、积极性和类人性呈初步正向关联。总体而言,多模态同步并非简单的叠加策略,设计 VR 中的共情对话代理时需慎重考虑语言与非语言行为的组合方式。
点评