中文

通过基于情境学习的自我对齐提升 LLM 对文化价值的对齐性

计算与语言 2025-09-09 v2

摘要

提升大型语言模型(LLM)对所编码文化价值的对齐性正成为日益重要的议题。本文研究我们能否在推理时利用现有的关于文化价值的知识来调整模型对文化价值探针的响应。我们提出一种简单且低成本的方法,结合情境学习(ICL)和人类调查数据,展示我们可以在包含英文中心模型和多语言 LLM 的 5 个模型上提升其对文化价值的对齐性。重要的是,我们展示该方法在测试语言(不局限于英文)中也有用,并且可以提升对应各种文化多样化国家的文化价值的对齐性。

关键词

引用

@article{arxiv.2408.16482,
  title  = {Self-Alignment: Improving Alignment of Cultural Values in LLMs via In-Context Learning},
  author = {Rochelle Choenni and Ekaterina Shutova},
  journal= {arXiv preprint arXiv:2408.16482},
  year   = {2025}
}