中文

Ada-Instruct:面向复杂推理的自适应指令生成器

计算与语言 2024-10-04 v3 人工智能

摘要

指令增强是释放大语言模型(LLM)在下游任务中全部潜力的关键步骤。现有 Self-Instruct 方法主要通过少样本初始指令结合上下文学习来模拟新指令。然而,我们的研究指出该方法的一个关键缺陷:即便使用 GPT4o,Self-Instruct 也无法生成长度 100\ge 100 的复杂指令,而这在代码补全等复杂任务中是必要的。为解决此问题,我们的核心见解是:仅用十个样本微调开源 LLM 即可生成在分布上保持一致的复杂指令,适用于复杂推理任务。我们引入 Ada-Instruct,一种通过微调开发的自适应指令生成器。我们在不同应用中实证验证了 Ada-Instruct 的有效性。结果凸显了 Ada-Instruct 生成长、复杂且分布一致指令的能力。

关键词

引用

@article{arxiv.2310.04484,
  title  = {Ada-Instruct: Adapting Instruction Generators for Complex Reasoning},
  author = {Wanyun Cui and Qianle Wang},
  journal= {arXiv preprint arXiv:2310.04484},
  year   = {2024}
}