AI-Researcher:自主科学创新的 AI 研究者
人工智能
2025-05-27 v1
摘要
大型语言模型 (LLM) 在数学和编码中的强大推理能力,结合其通过智能体框架自动化复杂任务的能力,为加速科学创新提供了前所未有的机遇。本文介绍了 AI-Researcher——一个完全自主的研究系统,旨在改变 AI 驱动的科学发现方式及其评估方法。我们的框架无缝地协调了完整的研究流程——从文献综述、假设生成到算法实现及面向出版的论文准备——几乎无需人工干预。为严格评估自主研究能力,我们开发了 Scientist-Bench——一个综合性基准,涵盖来自 diverse AI 研究领域的前沿论文,包括引导式创新和开放性探索任务。通过大量实验,我们展示了 AI-Researcher 取得了显著的实现成功率,并产生的研究论文接近人类水平的质量。这一工作为以系统性方式探索认知局限之外的解空间,从而补充人类研究者,奠定了新的自主科学创新基础。
引用
@article{arxiv.2505.18705,
title = {AI-Researcher: Autonomous Scientific Innovation},
author = {Jiabin Tang and Lianghao Xia and Zhonghang Li and Chao Huang},
journal= {arXiv preprint arXiv:2505.18705},
year = {2025}
}
备注
Code on github: https://github.com/HKUDS/AI-Researcher