中文

LIDA:一种利用大语言模型自动生成与语法无关的 visualizations 与 infographics 的工具

人工智能 2023-06-07 v3 人机交互 编程语言

摘要

支持用户自动创建可视化的系统必须处理若干子任务——理解数据语义、枚举相关可视化目标并生成可视化规范。本文中将可视化生成视为一个多阶段生成问题,并论证基于大语言模型(LLM,如 ChatGPT/GPT-4)与图像生成模型(IGM)的良好编排流水线适于应对这些任务。我们提出 LIDA,一种用于生成与语法无关的可视化与信息图的新工具。LIDA 包含 4 个模块——将数据转换为丰富而紧凑的自然语言摘要的 SUMMARIZER、给定数据枚举可视化目标的 GOAL EXPLORER、生成并精炼、执行及筛选可视化代码的 VISGENERATOR,以及利用 IGM 生成忠实于数据的风格化图形的 INFOGRAPHER 模块。LIDA 提供 python api 以及用于交互式图表、信息图与数据故事生成的混合用户界面(直接操作与多语言自然语言)。项目详情见 https://microsoft.github.io/lida/

关键词

引用

@article{arxiv.2303.02927,
  title  = {LIDA: A Tool for Automatic Generation of Grammar-Agnostic Visualizations and Infographics using Large Language Models},
  author = {Victor Dibia},
  journal= {arXiv preprint arXiv:2303.02927},
  year   = {2023}
}

备注

Accepted at ACL 2023 (Demonstration track). Fix formatting issues, update information on evaluation metrics, prompts and project website (https://microsoft.github.io/lida/)