中文

改进规则的例外

数据库 2016-06-02 v1

摘要

数据库界已开发了大量用于数据治理与探索的工具和技术,从声明式语言到数据修复的专门技术等等。然而,目前对于如何以简单、直观且最重要的是灵活的方式将这些强大工具暴露给分析人员,尚无共识。因此,分析人员继续依赖诸如电子表格、命令式语言以及像 Jupyter 这样的笔记本式编程环境来进行数据治理。在这项工作中,我们探索电子表格、笔记本与关系数据库的集成。我们聚焦于电子表格与命令式笔记本环境相对于经典关系数据库的一个关键优势:例外的便利性。通过依赖一次一组(set-at-a-time)操作,关系数据库牺牲了轻松定义单例操作的能力,即影响针对一组固定的显式定位记录的查询处理的正常数据处理工作流的例外。相比之下,电子表格用户可以轻松更改仅一个单元格的公式,而笔记本用户可以向其笔记本添加改变输出‘视图’的命令式操作。我们认为,在经典关系数据库中启用此类特殊手动转换对数据治理至关重要,因为易于针对单个值声明的数据治理操作往往极难推广。我们探索在关系数据库中启用单例操作的挑战,提出一种用于数据治理的混合电子表格/关系型笔记本环境,并展示我们对 Vizier 的愿景,这是一个通过此类接口暴露数据治理的系统。

关键词

引用

@article{arxiv.1606.00046,
  title  = {The Exception that Improves the Rule},
  author = {Juliana Freire and Boris Glavic and Oliver Kennedy and Heiko Mueller},
  journal= {arXiv preprint arXiv:1606.00046},
  year   = {2016}
}

备注

Authors in alphabetical order; Preprint for HILDA 2015