中文

机器加入道德圈:生成式 AI 代理在协同推理中的人格效应

人机交互 2026-03-24 v2

摘要

生成式AI日益被定位为协同学习中的伙伴,但其对伦理推理的影响尚不明确。我们报告了一项包含N=217名大学学生的随机对照实验,学生们在三种条件下讨论一个自动驾驶困境:人类专制、支持型AI同伴或持反对意见的AI同伴。运用道德基础词汇表、从增强式知识建构框架提取的论证编码、基于BERTopic和动态时间错位的语义轨迹建模,以及知识网络分析,我们追踪了AI人格如何重塑伦理话语。支持型AI相对于对照组增加了更具 grounding 和资格的论点,围绕关怀/公正进行整合性推理;而持反对意见的AI则在适度扩展伦理框架和维持价值多元主义方面发挥作用。两种AI条件都减少了主题漂移,表明话题聚焦更为稳定。讨论后的论证复杂度仅在道德框架和推理质量方面弱预测,最终的伦理决策转变主要由参与者初始立场驱动。总体而言,AI同伴更改变变了过程、道德框架和论证质量的分布与联系,而非道德选择的结果,凸显了生成式AI代理作为协同学习伙伴以引发反思性、多元化伦理推理的潜力。

关键词

引用

@article{arxiv.2511.01205,
  title  = {When Machines Join the Moral Circle: The Persona Effect of Generative AI Agents in Collaborative Reasoning},
  author = {Yueqiao Jin and Roberto Martinez-Maldonado and Wanruo Shi and Songjie Huang and Mingmin Zheng and Xinbin Han and Dragan Gasevic and Lixiang Yan},
  journal= {arXiv preprint arXiv:2511.01205},
  year   = {2026}
}