生存还是毁灭?对连续可控提示工程的探索
计算与语言
2023-11-17 v1
摘要
随着大语言模型使用的日益普及,参数高效微调及用于控制生成的其他方法在定制模型与管理其输出方面正获得关注。然而,精确控制提示如何影响这些模型的挑战仍是一个值得深入探究的领域。对此,我们提出ControlPE(连续可控提示工程,Continuously Controllable Prompt Engineering)。ControlPE实现了对提示效应的更精细调节,补充了现有提示工程,并有效控连续目标。该方法利用LoRA(低秩适配,Low-Rank Adaptation)的力量产生类似提示加权的效果,实现对提示影响的精细调整。我们的方法包括生成用于提示蒸馏的专用数据集,将这些提示整合进LoRA模型,并仔细调整LoRA合并权重以调节提示的影响。这提供了一个动态且适配的提示控制工具。通过实验,我们验证了ControlPE的实用性与有效性。它证明是控制各类提示(从生成简短回复提示、拒绝提示到思维链提示)的一个有前景的解决方案。
引用
@article{arxiv.2311.09773,
title = {To be or not to be? an exploration of continuously controllable prompt engineering},
author = {Yuhan Sun and Mukai Li and Yixin Cao and Kun Wang and Wenxiao Wang and Xingyu Zeng and Rui Zhao},
journal= {arXiv preprint arXiv:2311.09773},
year = {2023}
}