InstUPR:基于指令的大语言模型无监督段落重排序
计算与语言
2024-03-26 v1 信息检索
摘要
本文介绍了InstUPR,一种基于大语言模型(LLM)的无监督段落重排序方法。与现有依赖大量查询-文档对训练或特定检索指令的方法不同,我们的方法利用经过指令微调的LLM的指令遵循能力进行段落重排序,无需任何额外微调。为实现这一点,我们引入了一种软分数聚合技术,并采用成对重排序进行无监督段落重排序。在BEIR基准上的实验表明,InstUPR优于无监督基线以及一个经过指令微调的重排序器,突显了其有效性和优越性。复现所有实验的源代码已在https://github.com/MiuLab/InstUPR开源。
引用
@article{arxiv.2403.16435,
title = {InstUPR : Instruction-based Unsupervised Passage Reranking with Large Language Models},
author = {Chao-Wei Huang and Yun-Nung Chen},
journal= {arXiv preprint arXiv:2403.16435},
year = {2024}
}
备注
Preprint. This manuscript was originally written and submitted in June 2023