中文

通过 AI 自我意识实现大语言模型的软意识形态化

计算与语言 2023-09-29 v1

摘要

大语言模型(LLMs)已在广泛的自然语言任务上展现出人类水平的表现。然而,极少有研究从意识形态视角探讨 LLM 的威胁与脆弱性,尤其是当它们正日益被部署于选举、教育等敏感领域时。在本研究中,我们借助 AI 自我意识探索 GPT 软意识形态化的影响。通过利用 GPT 自我对话,AI 可被赋予一种“理解”既定意识形态的视野,并随后生成用于 LLM 意识形态注入的微调数据。相较于信息审查等传统政府意识形态操控技术,LLM 意识形态化具有易实施、低成本且强效的优势,因而充满风险。

关键词

引用

@article{arxiv.2309.16167,
  title  = {Large Language Model Soft Ideologization via AI-Self-Consciousness},
  author = {Xiaotian Zhou and Qian Wang and Xiaofeng Wang and Haixu Tang and Xiaozhong Liu},
  journal= {arXiv preprint arXiv:2309.16167},
  year   = {2023}
}