AIR:通过自动迭代细化生成复杂指令
计算与语言
2025-02-28 v2 人工智能
摘要
随着大型语言模型的发展,它们遵循简单指令的能力显著提升。然而,遵循复杂指令仍是一个主要挑战。当前的复杂指令生成方法往往与当前指令要求无关,或存在可扩展性和多样性有限的问题。此外,虽然翻译法在简单指令生成方面有效,但未能利用大型网络语料库中的丰富内容和结构。在本文中,我们提出了一种新型的自动迭代细化框架,用于生成带有约束的复杂指令,该框架不仅更好地反映了真实场景的要求,还显著提升了 LLM 遵循复杂指令的能力。AIR 框架包括两个阶段:(1)从文档生成初始指令;(2)通过比较模型输出与文档,以纳入有价值的约束,获得 LLM 作为评判员的指导下迭代细化指令。最后,我们构建了包含 10K 条复杂指令的 AIR-10K 数据集,并证明采用我们方法生成的指令显著提高了模型遵循复杂指令的能力,超越了现有指令生成方法。
引用
@article{arxiv.2502.17787,
title = {AIR: Complex Instruction Generation via Automatic Iterative Refinement},
author = {Wei Liu and Yancheng He and Hui Huang and Chengwei Hu and Jiaheng Liu and Shilong Li and Wenbo Su and Bo Zheng},
journal= {arXiv preprint arXiv:2502.17787},
year = {2025}
}
备注
The first three authors contributed equally, 20 pages