中文

AI 宣传机器人与语言模型

密码学与安全 2025-08-29 v1 人工智能 计算机与社会

摘要

AI 驱动的影响操作现在可以在廉价硬件上端到端执行。我们展示了小型语言模型产生连贯、以人物为导向的政治信息,并且可以自动评估而无需人类评估员。两个行为发现 emerged。首先,人物-模型: 人物设计解释了比模型身份更大的行为差异。其二,作为压力源: 当回复必须反驳论点时,意识形态的坚持会加强,极端内容的流行程度也随之上升。我们演示了完全自动化的影响内容生产已在大型和小型参与者的范围内实现。因此,防御应从限制模型访问转向以对话为中心的检测和破坏活动和协调基础设施。潜在地,极致的一致性也为检测提供了特征。

关键词

引用

@article{arxiv.2508.20186,
  title  = {AI Propaganda factories with language models},
  author = {Lukasz Olejnik},
  journal= {arXiv preprint arXiv:2508.20186},
  year   = {2025}
}