中文

什么才是好的自然语言提示符?

计算与语言 2025-06-10 v1

摘要

随着大型语言模型(LLM)向更符合人类水平的水平发展,人类与AI之间的交互日益增多,提示符已成为决定性因素。然而,关于何种量度自然语言提示符的概念共识有限。我们尝试回答此问题,通过对2022至2025年间来自主要NLP和AI会议及博客的150多篇与提示符相关的论文进行元分析。我们提出一种基于属性和人类的框架,用于评估提示符质量,涵盖21个属性,归类为六个维度。我们 then 检查了现有研究如何评估其对LLM的影响,揭示其在模型和任务上的支持不平衡,以及实质性研究空白。进一步,我们分析了高质量自然语言提示符中属性之间的相关性,得出提示优化建议。我们 then 在推理任务中探索了多属性提示增强,观察到单属性增强往往具有最大影响。最后,我们发现针对属性增强提示的指令调优可导致更好的推理模型。我们的发现为属性中心的提示评估与优化奠定了基础,弥合了人类-AI交互之间的差距,并开启了新的提示研究方向。

关键词

引用

@article{arxiv.2506.06950,
  title  = {What Makes a Good Natural Language Prompt?},
  author = {Do Xuan Long and Duy Dinh and Ngoc-Hai Nguyen and Kenji Kawaguchi and Nancy F. Chen and Shafiq Joty and Min-Yen Kan},
  journal= {arXiv preprint arXiv:2506.06950},
  year   = {2025}
}

备注

ACL 2025 Main Conference