RepBERT:用于第一阶段检索的上下文化文本嵌入
信息检索
2020-07-21 v2
摘要
尽管查询与文档间的精确词项匹配是执行第一阶段检索的主导方法,我们提出了一种不同的方法,称为 RepBERT,以定长上下文化嵌入来表示文档与查询。查询与文档嵌入的内积被视为相关性分数。在 MS MARCO Passage Ranking 任务上,RepBERT 在所有初始检索技术中取得了最先进的(SOTA)结果,且其效率可与词袋方法相媲美。
引用
@article{arxiv.2006.15498,
title = {RepBERT: Contextualized Text Embeddings for First-Stage Retrieval},
author = {Jingtao Zhan and Jiaxin Mao and Yiqun Liu and Min Zhang and Shaoping Ma},
journal= {arXiv preprint arXiv:2006.15498},
year = {2020}
}
备注
For corresponding code and data, see https://github.com/jingtaozhan/RepBERT-Index