关于暴力概念:人类与AI判断的比较研究
物理与社会
2026-02-20 v1 应用物理
计算物理
摘要
背景:暴力的界定既不明确,也不存在普遍共识。虽然身体攻击是原型性的,但当代社会日益关注排除、羞辱、网络骚扰或象征性行为是否应被归入同一道德范畴。同时,大型语言模型(LLM)正在被日常引用以解释和标记复杂的社会行为。这些系统是否复制、重塑或简化人类的暴力观念尚未知晓。方法:本文系统比较了人类判断与LLM分类,涵盖22个精心设计的道德分歧情景,范围从身体和语言攻击、关系动态、边缘化、象征性行为到语言表达。人类响应与来自不同规模和架构的指令调优模型输出进行比较。我们进行了全局、句子级和主题域分析,检视模型间的变异性,以评估模式的收敛性与差异性。发现:本研究将暴力视为战略选择的代理,通过其观察更广泛的信念形成动态过程。暴力不是研究的重点,但它作为工具用于探究更广泛的分析。它使对LLM如何操作模糊道德构念、协商概念边界以及将多元人类解释转化为单一输出的进行结构化调查成为可能。更广泛地说,研究发现为日常解释伤害、责任和社会规范的对话式AI的认识角色提供了见解,突显了透明度和批判性参与的重要性,因为这些系统日益中介化公共推理。
引用
@article{arxiv.2602.17256,
title = {On the Concept of Violence: A Comparative Study of Human and AI Judgments},
author = {Mariachiara Stellato and Francesco Lancia and Chiara Galeazzi and Nico Curti},
journal= {arXiv preprint arXiv:2602.17256},
year = {2026}
}