AI 与我的价值观:用户感知 LLM 能否从随意对话中提取、承载并解释人类价值观
人机交互
2026-04-15 v2 人工智能
计算与语言
摘要
AI 是否理解人类价值观 remains 一个开放的哲学问题,但我们采取务实的立场,通过引入 VAPT (Value-Alignment Perception Toolkit) 来研究 LLM 如何反映人们的价值观以及人们如何判断这些反映。20 名参与者在 chatbot 上进行一个月的文本交互,随后完成我们工具包提供的 2 小时访谈,评估 AI 提取 (获取细节)、承载 (由此做出决策)、解释 (提供证据) 这些价值的能力。13 名参与者最终确信 AI 能够理解人类价值观。因此,我们警告关于 'weaponized empathy' 的设计模式:即在与价值感知但福利不对齐的对话式智能体互动时可能出现的现象。VAPT 提供了一种新的方式来评估 AI 系统的价值对齐。我们还提供了设计建议,以在 AI 能力日益不可见、普适且后人类化的未来,负责任地构建具有透明度和安全措施的 AI 系统。
引用
@article{arxiv.2601.22440,
title = {AI and My Values: User Perceptions of LLMs' Ability to Extract, Embody, and Explain Human Values from Casual Conversations},
author = {Bhada Yun and Renn Su and April Yi Wang},
journal= {arXiv preprint arXiv:2601.22440},
year = {2026}
}
备注
To appear in CHI '26