中文

Silico-centric 心智理论

计算机视觉与模式识别 2024-03-15 v1 人工智能

摘要

心智理论(ToM)指的是对自身及他人的信念、欲望、意图和知识等心理状态进行归属,并理解这些心理状态可能不同于自身或现实的能力。我们探讨ToM在包含多个独立AI代理的环境中的应用,每个代理都拥有独特的内部状态、信息和目标。灵感来自人类误信实验,我们提出一种AI('焦点AI')的情景:其克隆体进行人类中心的ToM评估。我们引导焦点AI评估其克隆体是否受益于额外指令。同时,我们让克隆体进行ToM评估,分别是否附加指令,从而让焦点AI参与类似人类心智化的更高阶反事实推理——一种是针对人类,一种是针对其他AI。我们发现:当代AI在人类中心的ToM评估中表现出近乎完美的准确性。由于一个AI中嵌入的信息与其克隆体中完全相同,额外指令是冗余的。然而,我们观察到AI为其克隆体制定详尽的指令,错误地预期其需要帮助。一个独立的裁判AI也与这些不受支持的预期保持一致。无论是焦点AI还是裁判AI,在我们的'silico-centric'测试中都不表现出ToM。

关键词

引用

@article{arxiv.2403.09288,
  title  = {Adversarial Training with OCR Modality Perturbation for Scene-Text Visual Question Answering},
  author = {Zhixuan Shen and Haonan Luo and Sijia Li and Tianrui Li},
  journal= {arXiv preprint arXiv:2403.09288},
  year   = {2024}
}

备注

6 pages, 3 figures, accepted by 2024 IEEE International Conference on Multimedia and Expo