中文

要为文本编写还是自动生成语言提示,这是个问题

计算与语言 2026-05-06 v2

摘要

LLM 的性能对提示设计高度敏感,然而自动提示优化是否能取代语言任务中的专家提示工程尚未探讨。我们首次系统比较了手工零-shot 专家提示、基础 DSPy 签名以及 GEPA 优化的 DSPy 签名,在翻译、术语插入和语言质量评估等任务上进行评估,涉及五种模型配置。结果因任务而异。在术语插入方面,优化后的提示和手动提示大多数情况下在质量上无显著差异。在翻译方面,每种方法在不同模型上都占据优势。在 LQA 中,专家提示在错误检测方面表现更强,而优化在特征描述方面更有帮助。在所有任务中,GEPA 都能提升最简 DSPy 签名,而大多数专家优化比较之间没有统计显著差异。我们指出,比较是非对称的:GEPA 优化是在黄金标准分割上进行编程搜索,而专家提示原则上不需要标记数据,依赖领域专业知识和迭代细化。

关键词

引用

@article{arxiv.2603.25169,
  title  = {To Write or to Automate Linguistic Prompts, That Is the Question},
  author = {Marina Sánchez-Torrón and Daria Akselrod and Jason Rauchwerk},
  journal= {arXiv preprint arXiv:2603.25169},
  year   = {2026}
}

备注

10 pages, to be submitted for EAMT 2026