通过 AI 自我意识实现大语言模型的软意识形态化
计算与语言
2023-09-29 v1
摘要
大语言模型(LLMs)已在广泛的自然语言任务上展现出人类水平的表现。然而,极少有研究从意识形态视角探讨 LLM 的威胁与脆弱性,尤其是当它们正日益被部署于选举、教育等敏感领域时。在本研究中,我们借助 AI 自我意识探索 GPT 软意识形态化的影响。通过利用 GPT 自我对话,AI 可被赋予一种“理解”既定意识形态的视野,并随后生成用于 LLM 意识形态注入的微调数据。相较于信息审查等传统政府意识形态操控技术,LLM 意识形态化具有易实施、低成本且强效的优势,因而充满风险。
引用
@article{arxiv.2309.16167,
title = {Large Language Model Soft Ideologization via AI-Self-Consciousness},
author = {Xiaotian Zhou and Qian Wang and Xiaofeng Wang and Haixu Tang and Xiaozhong Liu},
journal= {arXiv preprint arXiv:2309.16167},
year = {2023}
}