SWI:大型语言模型中的带意图说话
计算与语言
2025-09-12 v3 人工智能
机器学习
摘要
意图通常被清晰地表述和规划,作为交流与解决问题的认知框架。本文在大型语言模型(LLM)中引入了带意图说话(SWI)的概念,其中显式生成的意图封装了模型的底层目的,并提供高层规划以指导后续的分析与行动。通过模拟人类大脑中深思熟虑且有目的的思考,假设 SWI 能够增强 LLM 的推理能力和生成质量。在文本摘要、多任务问答和数学推理基准上的大量实验一致证明了带意图说话相较于无显式意图的直接生成的有效性和泛化性。进一步分析证实了 SWI 在不同实验设置下的泛化性。此外,人工评估验证了 SWI 所产生意图的连贯性、有效性和可解释性。用显式意图增强 LLM 的可喜结果为利用认知概念提升 LLM 的生成与推理能力开辟了新途径。
引用
@article{arxiv.2503.21544,
title = {SWI: Speaking with Intent in Large Language Models},
author = {Yuwei Yin and EunJeong Hwang and Giuseppe Carenini},
journal= {arXiv preprint arXiv:2503.21544},
year = {2025}
}
备注
Code: https://github.com/YuweiYin/SWI