中文

AutoFigure:生成与细化出版级科学插图

人工智能 2026-02-13 v2 计算与语言 计算机视觉与模式识别 数字图书馆

摘要

高质量的科学插图对于有效传达复杂的科学和技术概念至关重要,但其手动创建仍在学术界和工业界广为人知地成为瓶颈。我们提出 FigureBench,这是第一个大规模基准数据集,用于从长篇科学文本生成科学插图。它包含 3,300 个高质量的科学文本-图形配对,涵盖来自科学论文、调查报告、博客和教科书的多样化文本到插图任务。此外,我们提出AutoFigure,第一个能够自动生成高质量科学插图的智能体框架。具体而言,在渲染最终结果之前,AutoFigure 通过广泛的推理、重组和验证以产生既结构严谨又审美精美的布局,输出实现结构完整性和审美吸引力的科学插图。利用来自 FigureBench 的高质量数据,我们进行了大量实验,以测试 AutoFigure 与各种基线方法的性能。结果表明,AutoFigure 始终优于所有基线方法,生成出版级的科学插图。该项目的源码、数据集和 Hugging Face 空间已发布于 https://github.com/ResearAI/AutoFigure。

关键词

引用

@article{arxiv.2602.03828,
  title  = {AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations},
  author = {Minjun Zhu and Zhen Lin and Yixuan Weng and Panzhong Lu and Qiujie Xie and Yifan Wei and Sifan Liu and Qiyao Sun and Yue Zhang},
  journal= {arXiv preprint arXiv:2602.03828},
  year   = {2026}
}

备注

Accepted at the ICLR 2026