NeFut Logo NeFut
EN 管理员登录

[AI学术] 情感能否反映自然语言中的道德观?初步注释研究揭示新方向

发布于:2026-07-25 22:00 最后更新:2026-07-26 07:44
#AI #Ethics #Moral Foundations

摘要

当前的人工智能(AI)伦理实现并未充分考虑情感或情绪。如果AI应与人类伦理对齐,深入研究AI行为是否能反映出人类的美德伦理行为显得尤为重要,尤其是情感在行动、判断或陈述中扮演的角色。

研究背景

在讨论主要的规范伦理理论时,虽然它们存在差异和不足之处,但美德伦理、结果主义和康德义务论等理论都在某种程度上考虑了人类情感。而流行的描述性伦理理论,情感基础理论,则将情感视为其许多基础的核心。

数据集构建

本研究提出了一个道德情感数据集,包含六位参与者对500个场景的注释,评估了行动/判断和后果的道德情感,评分范围从-1到1,这些场景来自Commonsense Norm Bank数据集。结果显示,情感特征与多类别(不道德/可自由裁量/道德)及二元不道德/道德分类之间存在显著关系。

结果与分析

使用正则化逻辑回归进行二元分类,得到了值得注意的Matthew相关系数为0.764,提供了情感特征在文本道德估计中的有效性早期证据。这表明,考虑他人反应的情感后果可用于推动更符合人类道德的AI发展。

未来方向

为了促进更深入的情感-道德计算研究,本研究的注释数据将根据请求提供给研究者。

博主点评: 本文探讨了情感与道德之间的关系,为AI伦理研究提供了新的视角。通过量化情感特征,研究者为创建更符合人类道德标准的AI奠定了基础,未来的研究值得期待。

原文链接: https://arxiv.org/abs/2607.20461

[h] 返回首页