要为文本编写还是自动生成语言提示,这是个问题
计算与语言
2026-05-06 v2
摘要
LLM 的性能对提示设计高度敏感,然而自动提示优化是否能取代语言任务中的专家提示工程尚未探讨。我们首次系统比较了手工零-shot 专家提示、基础 DSPy 签名以及 GEPA 优化的 DSPy 签名,在翻译、术语插入和语言质量评估等任务上进行评估,涉及五种模型配置。结果因任务而异。在术语插入方面,优化后的提示和手动提示大多数情况下在质量上无显著差异。在翻译方面,每种方法在不同模型上都占据优势。在 LQA 中,专家提示在错误检测方面表现更强,而优化在特征描述方面更有帮助。在所有任务中,GEPA 都能提升最简 DSPy 签名,而大多数专家优化比较之间没有统计显著差异。我们指出,比较是非对称的:GEPA 优化是在黄金标准分割上进行编程搜索,而专家提示原则上不需要标记数据,依赖领域专业知识和迭代细化。
引用
@article{arxiv.2603.25169,
title = {To Write or to Automate Linguistic Prompts, That Is the Question},
author = {Marina Sánchez-Torrón and Daria Akselrod and Jason Rauchwerk},
journal= {arXiv preprint arXiv:2603.25169},
year = {2026}
}
备注
10 pages, to be submitted for EAMT 2026