中文

AI-Researcher:自主科学创新的 AI 研究者

人工智能 2025-05-27 v1

摘要

大型语言模型 (LLM) 在数学和编码中的强大推理能力,结合其通过智能体框架自动化复杂任务的能力,为加速科学创新提供了前所未有的机遇。本文介绍了 AI-Researcher——一个完全自主的研究系统,旨在改变 AI 驱动的科学发现方式及其评估方法。我们的框架无缝地协调了完整的研究流程——从文献综述、假设生成到算法实现及面向出版的论文准备——几乎无需人工干预。为严格评估自主研究能力,我们开发了 Scientist-Bench——一个综合性基准,涵盖来自 diverse AI 研究领域的前沿论文,包括引导式创新和开放性探索任务。通过大量实验,我们展示了 AI-Researcher 取得了显著的实现成功率,并产生的研究论文接近人类水平的质量。这一工作为以系统性方式探索认知局限之外的解空间,从而补充人类研究者,奠定了新的自主科学创新基础。

关键词

引用

@article{arxiv.2505.18705,
  title  = {AI-Researcher: Autonomous Scientific Innovation},
  author = {Jiabin Tang and Lianghao Xia and Zhonghang Li and Chao Huang},
  journal= {arXiv preprint arXiv:2505.18705},
  year   = {2025}
}

备注

Code on github: https://github.com/HKUDS/AI-Researcher