试图弥合天际线与 top-k 查询之间的鸿沟
数据库
2022-03-25 v1
摘要
在多目标环境下识别偏好记录有两种最常用的范式:一种基于支配关系(如天际线算子),另一种基于定义在记录属性上的效用函数(通常使用 top-k 查询)。尽管它们非常流行,我们仍须考虑其主要缺点,这促使我们提出三项硬性需求:个性化、可控的输出规模,以及偏好指定的灵活性。事实上,天际线查询易于指定,但不具备任何适应使用者偏好或控制结果集基数的手段。相比之下,排序查询采用特定的评分函数对元组排序,可轻松控制输出规模,但难以正确指定该评分函数的权重以赋予各属性不同重要性。本文描述了三种不同的方法,试图满足上述三项硬性需求,同时兼取天际线查询与排序查询之长。这三种方法分别是:灵活天际线(Flexible Skyline)、ORD-ORU 和 UTK。
引用
@article{arxiv.2203.12744,
title = {Trying to bridge the gap between skyline and top-k queries},
author = {Alessandro Pindozzi},
journal= {arXiv preprint arXiv:2203.12744},
year = {2022}
}