Odyssey:分布式数据序列相似性搜索领域的一次探索
分布式、并行与集群计算
2023-01-27 v1 数据库
摘要
本文提出Odyssey,一种新颖的分布式数据序列处理框架,它通过利用由多核服务器构成的现代集群的全部计算能力,高效应对在数据序列处理中实现良好加速比与确保高可扩展性这一关键挑战。Odyssey解决了设计高效且高度可扩展的分布式数据序列索引中的若干挑战,包括高效调度与负载均衡,而无需付出在节点间移动数据的过高代价。它还支持一种灵活的局部复制方案,使Odyssey能够在查询应答过程中的数据可扩展性与良好性能之间的基本权衡中自如应对。通过广泛的配置并使用多个真实与合成数据集,我们的实验分析表明Odyssey实现了其极具挑战性的目标。
引用
@article{arxiv.2301.11049,
title = {Odyssey: A Journey in the Land of Distributed Data Series Similarity Search},
author = {Manos Chatzakis and Panagiota Fatourou and Eleftherios Kosmas and Themis Palpanas and Botao Peng},
journal= {arXiv preprint arXiv:2301.11049},
year = {2023}
}
备注
PVLDB 2023