大型语言模型生成的开放域隐式格式控制
计算与语言
2024-08-09 v1
摘要
控制大型语言模型(LLMs)生成输出的格式是众多应用中的关键功能。当前方法通常采用基于规则的自动机或使用手动编写格式指令进行微调的受限解码,这两种方法都难以处理开放域格式要求。为此,我们提出了一种 novel 框架,用于 LLMs 的受控生成,利用用户提供的单次问答对。本研究探讨了 LLMs 遵循开放域单次约束并复制示例答案格式的能力。我们观察到这是一个不容易的任务。我们还开发了一种用于监督式微调的数据集收集方法,以增强 LLMs 的开放域格式控制能力,而不会降低输出质量,同时构建了一个在此基础上进行评估的基准测试,以评估 LLM 输出的有用性和格式正确性。所得数据集命名为 OIFC-SFT,相关代码也将公开发布于 https://github.com/cofe-ai/OIFC。
引用
@article{arxiv.2408.04392,
title = {Open-domain Implicit Format Control for Large Language Model Generation},
author = {Yiqun Yao and Wenjia Ma and Xuezhi Fang and Xin Jiang and Xiang Li and Xuying Meng and Peng Han and Jing Li and Aixin Sun and Yequan Wang},
journal= {arXiv preprint arXiv:2408.04392},
year = {2024}
}
备注
6 pages