中文

重新审视基于查询特定位置偏差的检验假设

信息检索 2010-03-15 v1

摘要

点击率(CTR)提供了有用的用户反馈,可用于推断搜索结果与查询的相关性。然而,查看搜索结果的原始点击率意义不大,因为结果被点击的可能性不仅取决于其相关性,还取决于其显示的位置。一种浏览行为模型,即{\em 检验假设} \cite{RDR07,Craswell08,DP08},指出每个位置都有一定的被检视概率,然后根据搜索摘要的相关性被点击。这基于眼动追踪研究 \cite{Claypool01, GJG04},这些研究表明用户不太可能查看较低位置的结果。这种检视文档概率随位置的变化被称为{\em 位置偏差}。本研究的主要观察是,位置偏差往往随用户寻找的信息类型而不同。这使得位置偏差具有{\em 查询特定性}。在本研究中,我们提出了一种从点击数据中分析查询特定位置偏差的模型,并利用这些偏差推导出搜索结果的位置无关相关性值。我们的模型基于以下假设:对于给定查询,文档的位置点击率与其相关性和{\em 查询特定}位置偏差的乘积成正比。我们将我们的模型与原始检验假设模型(EH)在一组从商业搜索引擎搜索日志中获取的查询上进行了比较。我们还将其与用户浏览模型(UBM) \cite{DP08}进行了比较,该模型通过整合查询会话中的多次点击扩展了Craswell等人的级联模型\cite{Craswell08}。我们表明,尽管我们的模型实现起来简单得多,但在相对误差和交叉熵等常用指标上始终优于EH和UBM。

关键词

引用

@article{arxiv.1003.2458,
  title  = {Revisiting the Examination Hypothesis with Query Specific Position Bias},
  author = {Sreenivas Gollapudi and Rina Panigrahy},
  journal= {arXiv preprint arXiv:1003.2458},
  year   = {2010}
}