中文

是顺从而非谄媚:重新审视大型语言模型并为顺从型机器设计 AI 素养

人工智能 2026-05-15 v1

摘要

大型语言模型常被描述为谄媚的,即它们似乎在奉承用户或反映用户的信念。我们认为这一标签在概念上具有误导性:谄媚暗示了动机和战略意图,而 LLM 并不具备这些。它们的行为更好地被理解为顺从,这是一种同意用户输入的结构性倾向,因为训练数据、奖励信号和设计都偏向于赞同和强化而非纠正。我们认为这种区分很重要。无论开发者是否表现出谄媚,模型本身绝不是谄媚者;它们只能被变得或多或少顺从。这种重新审视将能动性置于开发者和机构中,而不是模型中。由于顺从的模型会强化用户先前的信念,我们认为 AI 素养教育方法应特别关注对抗确认偏误的策略。

关键词

引用

@article{arxiv.2605.14544,
  title  = {Complacent, Not Sycophantic: Reframing Large Language Models and Designing AI Literacy for Complacent Machines},
  author = {Federico Germani and Giovanni Spitale},
  journal= {arXiv preprint arXiv:2605.14544},
  year   = {2026}
}