Quda:面向可视化数据分析的自然语言查询
计算与语言
2020-12-04 v5 人机交互
信息检索
摘要
从自由文本中识别分析任务对于面向可视化的自然语言接口(V-NLIs)推荐有效可视化至关重要。然而,由于人类语言的模糊性与复杂性,这一任务具有挑战性。为应对该挑战,我们提出了一个称为 Quda 的新数据集,旨在通过训练和评估前沿的多标签分类模型,帮助 V-NLIs 从自由形式自然语言识别分析任务。我们的数据集包含 条多样化用户查询,每条均标注了一个或多个分析任务。我们通过先与数据分析师收集种子查询,再借助大量众包力量进行释义生成与验证来实现这一目标。我们通过三个应用展示了 Quda 的用处。本工作是构建用于识别分析任务的大规模语料库的首次尝试。随着 Quda 的发布,我们希望它能推动数据分析与可视化中 V-NLIs 的研究与开发。
引用
@article{arxiv.2005.03257,
title = {Quda: Natural Language Queries for Visual Data Analytics},
author = {Siwei Fu and Kai Xiong and Xiaodong Ge and Siliang Tang and Wei Chen and Yingcai Wu},
journal= {arXiv preprint arXiv:2005.03257},
year = {2020}
}