Ada-Instruct:面向复杂推理的自适应指令生成器
计算与语言
2024-10-04 v3 人工智能
摘要
指令增强是释放大语言模型(LLM)在下游任务中全部潜力的关键步骤。现有 Self-Instruct 方法主要通过少样本初始指令结合上下文学习来模拟新指令。然而,我们的研究指出该方法的一个关键缺陷:即便使用 GPT4o,Self-Instruct 也无法生成长度 的复杂指令,而这在代码补全等复杂任务中是必要的。为解决此问题,我们的核心见解是:仅用十个样本微调开源 LLM 即可生成在分布上保持一致的复杂指令,适用于复杂推理任务。我们引入 Ada-Instruct,一种通过微调开发的自适应指令生成器。我们在不同应用中实证验证了 Ada-Instruct 的有效性。结果凸显了 Ada-Instruct 生成长、复杂且分布一致指令的能力。
引用
@article{arxiv.2310.04484,
title = {Ada-Instruct: Adapting Instruction Generators for Complex Reasoning},
author = {Wanyun Cui and Qianle Wang},
journal= {arXiv preprint arXiv:2310.04484},
year = {2024}
}