构建具有类脑情感共情机制的利他与道德AI智能体
人工智能
2025-11-07 v2
摘要
随着AI与人类社会密切互动,确保其行为安全、利他并符合人类伦理道德价值观至关重要。然而,现有关于将伦理考量嵌入AI的研究仍不充分,以往基于原则和规则的外部约束不足以赋予AI长期稳定性和泛化能力。情感共情通过情感分享和感染机制,内在驱动旨在缓解他人负面情绪的利他行为。受此启发,我们从人类情感共情驱动的利他决策神经机制中汲取灵感,模拟共享的自我-他人感知-镜像-共情神经回路,构建了一个脑启发的情感共情驱动利他决策模型。在此模型中,共情直接影响多巴胺释放,形成内在利他动机。所提出的模型在三个实验场景中表现出一致的利他行为:情感感染集成的双智能体利他救援、多智能体博弈和机器人情感共情交互场景。深入分析验证了共情水平与利他偏好之间的正相关关系(与心理学行为实验结果一致),同时也展示了交互伙伴的共情水平如何影响智能体的行为模式。我们进一步测试了所提模型在涉及自利与他人福祉冲突的道德困境、部分可观测环境以及对抗性防御场景中的性能和稳定性。这项工作为类人共情驱动的利他道德决策提供了初步探索,为开发符合伦理的AI贡献了潜在视角。
引用
@article{arxiv.2410.21882,
title = {Building Altruistic and Moral AI Agent with Brain-inspired Emotional Empathy Mechanisms},
author = {Feifei Zhao and Hui Feng and Haibo Tong and Zhengqiang Han and Erliang Lin and Enmeng Lu and Yinqian Sun and Yi Zeng},
journal= {arXiv preprint arXiv:2410.21882},
year = {2025}
}
备注
Accepted by TAFFC