中文

InstUPR:基于指令的大语言模型无监督段落重排序

计算与语言 2024-03-26 v1 信息检索

摘要

本文介绍了InstUPR,一种基于大语言模型(LLM)的无监督段落重排序方法。与现有依赖大量查询-文档对训练或特定检索指令的方法不同,我们的方法利用经过指令微调的LLM的指令遵循能力进行段落重排序,无需任何额外微调。为实现这一点,我们引入了一种软分数聚合技术,并采用成对重排序进行无监督段落重排序。在BEIR基准上的实验表明,InstUPR优于无监督基线以及一个经过指令微调的重排序器,突显了其有效性和优越性。复现所有实验的源代码已在https://github.com/MiuLab/InstUPR开源。

关键词

引用

@article{arxiv.2403.16435,
  title  = {InstUPR : Instruction-based Unsupervised Passage Reranking with Large Language Models},
  author = {Chao-Wei Huang and Yun-Nung Chen},
  journal= {arXiv preprint arXiv:2403.16435},
  year   = {2024}
}

备注

Preprint. This manuscript was originally written and submitted in June 2023