改进 LLM 工具使用:重排序与拒绝选项
计算与语言
2024-10-17 v1
摘要
最近提出的 ToolkenGPT 工具学习范式显示出有前景的性能,但存在两个主要问题:首先,它无法从工具文档中获益,其次,它常常在是否使用工具方面出错。我们提出 Toolken+ 通过对 ToolkenGPT 选取的前 个工具进行重排序来缓解第一个问题,并通过特殊的“拒绝”选项来缓解第二个问题,当“拒绝”被排名第一时,模型将生成一个词汇 token。我们在多步骤数值推理和工具选择任务上展示了 Toolken+ 的有效性。
关键词
引用
@article{arxiv.2410.12004,
title = {Toolken+: Improving LLM Tool Usage with Reranking and a Reject Option},
author = {Konstantin Yakovlev and Sergey Nikolenko and Andrey Bout},
journal= {arXiv preprint arXiv:2410.12004},
year = {2024}
}
备注
EMNLP 2024 Findings