中文

大语言模型群体中涌现的社会惯例与集体偏见

多智能体系统 2025-05-30 v2 人工智能 计算机与社会 物理与社会

摘要

社会惯例是社会协调的支柱,塑造着个体如何形成群体。随着越来越多的人工智能(AI)智能体通过自然语言进行交流,一个基本问题是它们能否自举构建社会的基础。在这里,我们展示了实验结果,证明了在去中心化的大语言模型(LLM)智能体群体中,普遍采用的社会惯例会自发涌现。然后,我们展示了在此过程中如何出现强烈的集体偏见,即使智能体个体没有表现出任何偏见。最后,我们研究了由对抗性LLM智能体组成的坚定少数群体如何通过将替代性社会惯例强加给更大的群体来推动社会变革。我们的结果表明,AI系统可以在没有显式编程的情况下自主发展出社会惯例,并对设计符合并持续符合人类价值观和社会目标的AI系统具有启示意义。

关键词

引用

@article{arxiv.2410.08948,
  title  = {Emergent social conventions and collective bias in LLM populations},
  author = {Ariel Flint Ashery and Luca Maria Aiello and Andrea Baronchelli},
  journal= {arXiv preprint arXiv:2410.08948},
  year   = {2025}
}